{"as_of":"2026-08-09T13:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e09adde3448e3bce6d977c0423a332bf20270e564c7c80a775092ad198126085","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:38:36.716242Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:34:38.462448Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T02:38:17.343103Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12977","snapshot_observed_at":"2026-08-06T11:34:38.462448Z","title":"Non-differentiable reward optimization for diffusion- based autonomous motion planning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22615","last_updated":"2025-07-30T12:36:05Z","snapshot_observed_at":"2026-08-06T11:34:37.700417Z","submitted_at":"2025-07-30T12:36:05Z","title":"Generative Active Learning for Long-tail Trajectory Prediction via Controllable Diffusion Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T11:34:38.462448Z"},"links":{"cited_paper":"/paper/2507.12977","citing_paper":"/paper/2507.22615"},"observation_digest":"sha256:ad0b5959d6581b1e2b66944775f78696341ad8da420ca92f8f76b6b87e5332a4","observation_id":"9477e58b-7f42-474b-930f-950d54d316e3","resolution":{"observed_at":"2026-08-06T11:34:38.462448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"cited_work":{"arxiv_id":"2507.12977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12977","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Non-differentiable reward optimization for diffusion-based autonomous motion planning","venue":null,"work_id":"fbfb0121-015e-4c9b-bf82-d66f7923691c","year":2025},"citing_paper":{"arxiv_id":"2604.19267","last_updated":"2026-04-21T09:32:59Z","snapshot_observed_at":"2026-08-09T01:06:12.164202Z","submitted_at":"2026-04-21T09:32:59Z","title":"Multimodal embodiment-aware navigation transformer","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T02:37:50.624886Z"},"links":{"cited_paper":"/paper/2507.12977","citing_paper":"/paper/2604.19267"},"observation_digest":"sha256:f33bce8bad57b3f799033b55f464a20a21e1112e5cdc7a1b17bc23faeb157a48","observation_id":"5e59496e-71a2-4290-a56d-2d6428f439fa","resolution":{"observed_at":"2026-05-10T02:38:17.344445Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.12977/citation-record","integrity":"/paper/2507.12977/integrity","json":"/paper/2507.12977/citation-record.json","paper":"/paper/2507.12977"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:46.979683Z","title":"St-p3: End- to-end vision-based autonomous driving via spatial-temporal feature learning,","venue":null,"work_id":"7444198d-1c9b-4e8c-9abc-e25ae36d6476","year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.038782Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:bd06bb31a971626252b355a7d4e55e2ed6264567d6a6881d6db87775895860a2","observation_id":"faf8fca2-41d8-4109-8203-e470469574af","resolution":{"observed_at":"2026-08-06T16:38:47.150044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:46.724769Z","title":"Per- ceive, predict, and plan: Safe motion planning through interpretable semantic representations,","venue":null,"work_id":"d20f4bd2-60a2-412e-977a-8914ecc9043d","year":2020},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.116542Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:0a7eee4f055238fe98aa4626ebb05a0c76f7b045917f4b4722f9fa6daf728de9","observation_id":"c6ab466e-753e-4f9c-a006-8e9635ed060b","resolution":{"observed_at":"2026-08-06T16:38:46.831482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:46.447595Z","title":"Dsdnet: Deep structured self-driving network,","venue":null,"work_id":"028bcb49-3104-4e46-aa9e-01513951fb2b","year":2020},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.242568Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:c83357ac7dea734649968d22ee052461de364692588133eefed2e21cc5e0b03f","observation_id":"66c0482e-4272-4b80-8524-1b3f73df66bc","resolution":{"observed_at":"2026-08-06T16:38:46.581600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:46.214170Z","title":"Multi-modal knowl- edge distillation-based human trajectory forecasting,","venue":null,"work_id":"06debc3b-2c46-4384-8a48-2b4d81848afe","year":2025},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.405170Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:84a166f561c9424b35b1dd43272b1d81bb85dabeab1f92dd9b0f826dca1f0a8d","observation_id":"1d7728ca-2930-480e-8e9d-d10de4f472a0","resolution":{"observed_at":"2026-08-06T16:38:46.330651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:45.950466Z","title":"Fast-replanning motion control for non-holonomic vehicles with aborting a*,","venue":null,"work_id":"7d745b01-d343-417e-bde3-c0f6db34d0c4","year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.516413Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:2cec1e8b01b2db484ef12f2031b28ff58852c1d73dccb55c5e695d3eb513a6bb","observation_id":"e5b3705b-37f2-4c92-bb5a-dc368687b641","resolution":{"observed_at":"2026-08-06T16:38:46.085755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:45.733835Z","title":"Informed rrt*: Optimal sampling-based path planning focused via direct sampling of an admissible ellipsoidal heuristic,","venue":null,"work_id":"9da8189f-01b3-4be7-9832-2ec0df3c0450","year":2014},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.672535Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:923a02574d767fc2e3fb1496fb17f2d0d7e6f0059323ff4f97966dba437981e0","observation_id":"22693db8-4841-4acb-8402-031293c46cf0","resolution":{"observed_at":"2026-08-06T16:38:45.826865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:45.568984Z","title":"Path planning using neural a* search,","venue":null,"work_id":"df207a1f-cae8-42c0-8283-8e525f976e45","year":2021},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.823754Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:551a4610696be98df429ff17b6db86732207e6750a639f2f4c69337fd17b46b1","observation_id":"7c348d81-fff9-49f8-842a-7c9e1a1ed09e","resolution":{"observed_at":"2026-08-06T16:38:45.632277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:30.938700Z","title":"Sampling-based algorithms for optimal motion planning,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.938700Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:dc84e937cb8b8722e358491a55cab7f447f916c542364cd043477a94a78efaff","observation_id":"a6c96eca-9795-4be6-a548-d90b8f389437","resolution":{"observed_at":"2026-08-06T16:38:30.938700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:45.350662Z","title":"Deep imitation learning for autonomous driving in generic urban scenarios with enhanced safety,","venue":null,"work_id":"5d6ca208-564d-478f-894e-7b0dfd9a985f","year":2019},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.065718Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:42b2fb442c579b8b0e15d5306126ae8a619d5195f159b8a8aa8d213520ce6111","observation_id":"96472994-1514-49d9-b45a-517e6eb99ca2","resolution":{"observed_at":"2026-08-06T16:38:45.440891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:45.076358Z","title":"Safe reinforcement learning with stability guarantee for motion planning of autonomous vehicles,","venue":null,"work_id":"84726b1c-c68d-43d4-9b52-cedd16a91865","year":2021},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.176073Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:b5ff9d68ac617c7d6ec9dc752096561e9d50b4ef244b604bf366ab2a9acd3763","observation_id":"dd7a703f-1053-4687-8ca0-bb91cc1921d0","resolution":{"observed_at":"2026-08-06T16:38:45.213239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:44.886987Z","title":"Parting with misconceptions about learning-based vehicle motion planning,","venue":null,"work_id":"01361247-6d25-47b4-b191-a4490764883f","year":2023},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.336254Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:8904cd68ff8b6b33295ca185f246bebe8d401982370a65ed3c32aa2eee3f3550","observation_id":"233752d2-440c-4f18-9d56-686eea03e744","resolution":{"observed_at":"2026-08-06T16:38:44.980803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11796","last_updated":"2023-08-28T09:00:50Z","snapshot_observed_at":"2026-07-06T14:08:37.178824Z","submitted_at":"2022-10-21T08:19:45Z","title":"Differentiable Constrained Imitation Learning for Robot Motion Planning and Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11796","snapshot_observed_at":"2026-08-06T16:38:31.433701Z","title":"Dif- ferentiable constrained imitation learning for robot motion planning and control,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.433701Z"},"links":{"cited_paper":"/paper/2210.11796","citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:d7f4937e66e14e9c7566b009ce6458d1e273f68cf3731c30ff1dce9f1fd5f5dc","observation_id":"424207c6-bbf6-45dd-9d4e-f28c123a3bde","resolution":{"observed_at":"2026-08-06T16:38:31.433701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:44.643514Z","title":"Diffusion-es: Gradient-free planning with diffusion for autonomous and instruction-guided driving,","venue":null,"work_id":"28479cb2-2b1b-44a5-b72c-afc17a7bde8d","year":2024},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.584764Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:b333f664c5251be39944a765599b8f9ef5d6c1bc9f45f215ab69f2d0ef82c671","observation_id":"71c2c8ac-a34f-407b-bbaf-910628542620","resolution":{"observed_at":"2026-08-06T16:38:44.782389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:44.449398Z","title":"Motiondiffuser: Controllable multi-agent motion prediction using diffusion,","venue":null,"work_id":"e7800dc2-389f-44f5-9594-fb030fd6cb76","year":2023},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.696711Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:836feca5c2a055faa491607be96f1e933cd5f53a077a65897eaa7c6b35fcfc27","observation_id":"f4136118-a487-43f7-8e4d-7c557a609ca7","resolution":{"observed_at":"2026-08-06T16:38:44.543937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:31.813252Z","title":"Diffusion models beat gans on image synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.813252Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:152c768b930726dc866fcff665492033db2ffc64b373d36032b573be3faab221","observation_id":"56940f92-5fd7-4254-8b75-aed2a20daac9","resolution":{"observed_at":"2026-08-06T16:38:31.813252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:44.086730Z","title":"Language-guided traffic simulation via scene-level diffu- sion,","venue":null,"work_id":"2057120c-3333-4f96-9daa-e62effb82e90","year":2023},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.960323Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:b977c8c97fab968ad5ff570eaad94a25a52332f23bcdfafbee8a21d3e9c74ba5","observation_id":"ce492428-58aa-4220-8a1b-5977589a9920","resolution":{"observed_at":"2026-08-06T16:38:44.267630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:43.830847Z","title":"Safe-sim: Safety-critical closed-loop traffic simulation with diffusion- controllable adversaries,","venue":null,"work_id":"be82a50e-0b79-4e41-a0de-7044b8b6dc3b","year":2025},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:32.094513Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:24b30a037d55f1cf2e18a18b95faca03fd9d07250d77f0b480776be907cb524a","observation_id":"d1e7c7ef-8d61-4728-8256-36fc0c2fa831","resolution":{"observed_at":"2026-08-06T16:38:43.946422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19279","last_updated":"2024-03-28T10:02:10Z","snapshot_observed_at":"2026-08-08T13:11:57.462199Z","submitted_at":"2024-03-28T10:02:10Z","title":"Fine-Tuning Language Models with Reward Learning on Policy","version":1},"cited_work":{"arxiv_id":"2403.19279","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.19279","snapshot_observed_at":"2026-08-06T16:38:37.065338Z","title":"Fine-Tuning Language Models with Reward Learning on Policy","venue":"cs.CL","work_id":"2f0b6672-3e93-4e92-9b92-6e38f0308128","year":2024},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:32.272467Z"},"links":{"cited_paper":"/paper/2403.19279","citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:a4c9734235c084d19f4505be860243d5eb77851239a591653fbd41bbf050dde3","observation_id":"40bb854f-01ac-48bd-aa67-351e05df5eba","resolution":{"observed_at":"2026-08-06T16:38:37.143823Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:43.527640Z","title":"Training diffusion models with reinforcement learning,","venue":null,"work_id":"0f0ce114-c9f0-46ed-8380-65c844409972","year":2024},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:32.426350Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:af13df9e9fe1ca8a522763921f17f33399254bc43db6467e56ce1dcd37ed3ec1","observation_id":"1404fe10-6cb0-471d-8729-1f59112944bf","resolution":{"observed_at":"2026-08-06T16:38:43.624323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:32.615647Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:32.615647Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:cc0fcffb83ea64b0a904907003a8b4d2fb967ecc855c8ef3c83bf476670a65d6","observation_id":"e3af2e56-e04b-48c8-9eb3-fed313891c33","resolution":{"observed_at":"2026-08-06T16:38:32.615647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:43.219747Z","title":"Improved denoising diffusion prob- abilistic models,","venue":null,"work_id":"8aee1ae1-ac42-445f-b962-698838318e01","year":2021},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:32.731481Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:683ccb893482e3d19a5b34b356ffcd2c0eff0ebbcbac06fc2cc68539c6420be3","observation_id":"a0861cf5-8a3e-4acf-b34c-0c0acbb43bd0","resolution":{"observed_at":"2026-08-06T16:38:43.355616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:42.892973Z","title":"Improving transferability for cross- domain trajectory prediction via neural stochastic differential equa- tion,","venue":null,"work_id":"988329f5-b209-475e-b952-10fae7750684","year":2024},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:32.880110Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:56b56bff627360cfacb6426c455e1fc9582ecd12daa5f2a0f87dfa40d53c3786","observation_id":"6ad6cba7-d1f8-492e-bf7c-8418c0efb21a","resolution":{"observed_at":"2026-08-06T16:38:43.044648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:42.641130Z","title":"Maximum likelihood training of score-based diffusion models,","venue":null,"work_id":"db9b8c7c-6f0b-4c6f-a7e2-33b8b3b84f83","year":2021},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.044271Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:ab65ad9255a208179c324aef51332d184584f535ce1e0717f2d7b21819c4fec6","observation_id":"92f19643-57e4-4231-b71d-872aeed50c45","resolution":{"observed_at":"2026-08-06T16:38:42.756492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04809","last_updated":"2024-10-07T07:42:59Z","snapshot_observed_at":"2026-07-06T19:28:52.383175Z","submitted_at":"2024-10-07T07:42:59Z","title":"Data-driven Diffusion Models for Enhancing Safety in Autonomous Vehicle Traffic Simulations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04809","snapshot_observed_at":"2026-08-06T16:38:33.177376Z","title":"Data-driven diffusion models for enhancing safety in autonomous vehicle traffic simulations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.177376Z"},"links":{"cited_paper":"/paper/2410.04809","citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:5d8c9b428c2edd118cb4abb70b147e253a7bf7934073a66f2859386a26d68dfe","observation_id":"022fdce8-2253-41df-84a9-a17987f66f26","resolution":{"observed_at":"2026-08-06T16:38:33.177376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.09991","last_updated":"2022-12-21T01:06:18Z","snapshot_observed_at":"2026-08-06T05:32:02.292779Z","submitted_at":"2022-05-20T07:02:03Z","title":"Planning with Diffusion for Flexible Behavior Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.09991","snapshot_observed_at":"2026-08-06T16:38:33.283453Z","title":"Plan- ning with diffusion for flexible behavior synthesis,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.283453Z"},"links":{"cited_paper":"/paper/2205.09991","citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:9c0ab0ae073bee759c2ca375c417fe504040f564d0c34babb4c7c61d606f80ce","observation_id":"5f04bf3a-a7c5-4256-b534-67cd80d675f5","resolution":{"observed_at":"2026-08-06T16:38:33.283453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:42.371138Z","title":"Leveraging future relationship reasoning for vehicle trajectory prediction,","venue":null,"work_id":"03f07dee-690b-44c0-99dd-686220b614dc","year":2023},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.400990Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:9ea366617405a59875cfcc3a0eb762b39069abdd048b3759c2a476f0398b1174","observation_id":"5a0a298e-080c-43fa-95ac-a15f4603fb61","resolution":{"observed_at":"2026-08-06T16:38:42.507763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:33.539006Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.539006Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:03215a054e6f60948e66a82898ebe5ee3b39f1dc15043ba872b325ff38f25bf0","observation_id":"4dc59fa4-4fac-47b7-9879-ccd76c0ca9fd","resolution":{"observed_at":"2026-08-06T16:38:33.539006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:42.047819Z","title":"Human-level control through deep reinforcement learning,","venue":null,"work_id":"e36788e6-e724-433e-811a-5ceec064c67e","year":2015},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.686261Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:70cf10a82d947d90477d4e888704d7a7aaa096814bb8d934f19f6429aef404c6","observation_id":"697deb55-7215-4d23-aa20-cd32d652cc1d","resolution":{"observed_at":"2026-08-06T16:38:42.194764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:33.811079Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.811079Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:603bf36eb7965e0f3e0d0182066abe1c805ab1f2ec2f90715d798667a701c951","observation_id":"bd6870bd-9931-4757-b50a-81e8076a8731","resolution":{"observed_at":"2026-08-06T16:38:33.811079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:33.928478Z","title":"A markovian decision process,","venue":null,"work_id":null,"year":1957},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.928478Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:d047760d95e72fec604e72d85ea9e2b981253fa512cfb7d0c56d7a459e1e12bf","observation_id":"a9ef963a-46d0-4348-8568-0c152cea7b0d","resolution":{"observed_at":"2026-08-06T16:38:33.928478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:41.698934Z","title":"Deterministic policy gradient algorithms,","venue":null,"work_id":"645aad43-65fb-493a-96d2-8a4906fe3cd7","year":2014},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:34.055208Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:ec3499d5456fb4c6555579ad8d7b738b8670f5a49fa534e34b7962d08eb3c282","observation_id":"65ec2c56-ae69-4d0d-b0d5-efac8f5567b4","resolution":{"observed_at":"2026-08-06T16:38:41.817679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:41.358779Z","title":"Comprehensive reactive safety: No need for a trajectory if you have a strategy,","venue":null,"work_id":"03957c29-a4dd-4ab6-ba25-3a3301bdac49","year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:34.275662Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:92c53e79212ccc2b18a9b32692f9e2027476779f2651a895db3553a79d9f51cd","observation_id":"e1163659-b9b2-4450-8d61-959a4728aaa3","resolution":{"observed_at":"2026-08-06T16:38:41.510705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:41.028276Z","title":"Autonomous driving motion planning with constrained iterative lqr,","venue":null,"work_id":"4595da2f-1137-4d70-9d84-e4b7fe1eefd1","year":2019},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:34.388940Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:18e99011f62ead31b6015cf9fcd80a5c6f728a4483235114746129e45a6e50ac","observation_id":"43a29ff3-811f-40de-8e6a-cacfe5926601","resolution":{"observed_at":"2026-08-06T16:38:41.216894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:40.735746Z","title":"Leader: Learning attention over driving behaviors for planning under uncertainty,","venue":null,"work_id":"78368772-8958-437a-9ee2-07d6d6a66745","year":2023},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:34.495658Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:4874f68c4116019b9f1bf97396e83a8a721bf83dc3446a6c17b65efcdefd6338","observation_id":"e57640ad-2962-4086-b6e5-013ec4440039","resolution":{"observed_at":"2026-08-06T16:38:40.876894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:40.506365Z","title":"Kb-tree: Learnable and continuous monte- carlo tree search for autonomous driving planning,","venue":null,"work_id":"ff631835-d43c-439b-b6c4-e1f7dd74763e","year":2021},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:34.660594Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:cf7a704ecae9f42954f150719dbd2773c1169ce148c218b51100e429c67c3f69","observation_id":"4e2ae681-4809-4b72-8e39-20da45b38e36","resolution":{"observed_at":"2026-08-06T16:38:40.618371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:40.181650Z","title":"Driving maneuvers prediction based autonomous driving control by deep monte carlo tree search,","venue":null,"work_id":"3b80d97f-2cb2-44d3-91c7-bbc6fb307b63","year":2020},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:34.837308Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:d4eb93331f6fe01a820e2c53f03c1b3090cafc7497dff866583ce7619e82bf0c","observation_id":"cc8420a6-6c07-47f9-9e84-c42e8b3b83ea","resolution":{"observed_at":"2026-08-06T16:38:40.307644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:39.927081Z","title":"Crowd-robot interaction: Crowd-aware robot navigation with attention-based deep reinforce- ment learning,","venue":null,"work_id":"d2620f3b-797c-4afe-ae9f-183b180ed346","year":2019},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:35.004659Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:5737278f6acfd851115fbe39c118bf4ed9d4f07dae647337fcbc017ca266124c","observation_id":"5a5bd1f6-1ae4-48ce-8f39-3ec7acbff972","resolution":{"observed_at":"2026-08-06T16:38:40.057558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:39.638719Z","title":"Rethinking closed-loop training for autonomous driving,","venue":null,"work_id":"5fa1f3fa-2bdd-4f2b-8620-b9306314fd0a","year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:35.175208Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:a307acbd7ec46d22845858a1ba457b7df8aa9293dca6ae00dd4713eb1c9e561c","observation_id":"2426f62b-00e3-43c9-bb91-ba36bea1ced6","resolution":{"observed_at":"2026-08-06T16:38:39.793267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11097","last_updated":"2022-06-28T09:54:03Z","snapshot_observed_at":"2026-07-06T12:10:46.147640Z","submitted_at":"2021-11-22T10:37:52Z","title":"UMBRELLA: Uncertainty-Aware Model-Based Offline Reinforcement Learning Leveraging Planning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.11097","snapshot_observed_at":"2026-08-06T16:38:35.279970Z","title":"Umbrella: Uncertainty-aware model-based offline reinforcement learning leveraging planning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:35.279970Z"},"links":{"cited_paper":"/paper/2111.11097","citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:bc8623066657232b781bd676ececec4bbbeab599a988d64c2604bd5bbe40ac64","observation_id":"cfa90fd5-bbc6-4a6f-ab0d-a081db8ea412","resolution":{"observed_at":"2026-08-06T16:38:35.279970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.00374","last_updated":"2024-04-03T14:26:32Z","snapshot_observed_at":"2026-08-07T15:39:37.899352Z","submitted_at":"2019-03-01T15:40:19Z","title":"Model-Based Reinforcement Learning for Atari","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.00374","snapshot_observed_at":"2026-08-06T16:38:35.402897Z","title":"Model-based reinforcement learning for atari,","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:35.402897Z"},"links":{"cited_paper":"/paper/1903.00374","citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:723e1e18f07b929d6cef6669b2964e6237135cbd037910711d9861fe14590cb2","observation_id":"5480b033-6841-4eb0-8a9e-36d72bf2e98d","resolution":{"observed_at":"2026-08-06T16:38:35.402897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:39.351505Z","title":"Approximately optimal approximate reinforcement learning,","venue":null,"work_id":"bcd22100-986b-4814-8a40-ad888fd648c5","year":2002},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:35.558259Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:ff57a58cd07ef018d71d3a3daea0a8e1ca1970f0511cb22812f4998312b2be9b","observation_id":"e4b71ebc-b3b0-4a22-97d6-0684ffe7abb5","resolution":{"observed_at":"2026-08-06T16:38:39.465099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-08T15:29:26.223468Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-06T16:38:35.692097Z","title":"High- dimensional continuous control using generalized advantage estima- tion,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:35.692097Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:bfdb86f150c3fec1d99dc5fece088c4251f5252a279e0ad7e0f03e52df1c0dcf","observation_id":"cfc50aff-d961-484a-8a3a-33a276314092","resolution":{"observed_at":"2026-08-06T16:38:35.692097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:39.061959Z","title":"You’ll never walk alone: Modeling social behavior for multi-target tracking,","venue":null,"work_id":"40ba2cbe-af8f-49e9-867c-a15f0d88e03b","year":2009},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:35.873363Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:07482740e582f62c9d771157121230ca8afef94a5470eb53ccd7645ca20e3265","observation_id":"8bee159c-9eb9-454b-ab7e-b295b75b1d86","resolution":{"observed_at":"2026-08-06T16:38:39.188418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:38.755477Z","title":"Crowds by example,","venue":null,"work_id":"b25b4569-ea4d-4ee6-af88-737915a4159e","year":2007},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:36.019114Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:68bdf424b7c0eb2cc9409f78d4efd6a966d98fb442b640e242727eda2265504e","observation_id":"b87a31c1-40b2-4398-9c5b-dc162035a206","resolution":{"observed_at":"2026-08-06T16:38:38.877846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:38.483956Z","title":"A game-theoretic framework for joint forecasting and planning,","venue":null,"work_id":"3fcd0e2e-4970-4f77-8f36-ed4e691cff63","year":2023},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:36.142468Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:e4bfc75de209c7ce11bb8735a1494fd8dca4ba668293b6eb95fef360b926f4c4","observation_id":"fbb7d610-3bb4-4584-8ab6-f7114cbe6d42","resolution":{"observed_at":"2026-08-06T16:38:38.596213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:38.243634Z","title":"Human trajectory prediction via neural social physics,","venue":null,"work_id":"dc96a1be-fb5f-4a03-a5d9-d2c92ca699de","year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:36.311109Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:f1824ff2a9825e7c858ad183afab65ac3c5f4a292f0b1902374f4e679a9fcfa0","observation_id":"a8c5f799-b57f-4978-a72f-d43ba4163ddf","resolution":{"observed_at":"2026-08-06T16:38:38.346033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:37.942743Z","title":"Dtpp: Differentiable joint conditional prediction and cost evaluation for tree policy planning in autonomous driving,","venue":null,"work_id":"974b0036-7eab-4854-9ba2-46f9f22dba5f","year":2024},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:36.450342Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:d4d90a5fe9c0f6e6cd9aee133e581a2c75ac0ffefb9d7c6ae1214aecc3d2a54e","observation_id":"36f629b8-3a35-4601-9aa3-1289bb3193c4","resolution":{"observed_at":"2026-08-06T16:38:38.084375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:37.678610Z","title":"Differentiable integrated motion prediction and planning with learnable cost function for autonomous driving,","venue":null,"work_id":"67ba94b5-98af-4369-b492-660c3a408a0a","year":2023},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:36.598662Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:1020d1c3252a88e1b5e2af87fee5d862bbc0bd4fffa995181d5a0fdc29cbebf3","observation_id":"18d390bf-2c40-41fc-9771-baac2345d6b5","resolution":{"observed_at":"2026-08-06T16:38:37.809300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:37.376921Z","title":"Stochastic trajectory prediction via motion indeterminacy diffusion,","venue":null,"work_id":"99f50f3f-f45b-43e5-9801-a20bdc7ad89c","year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:36.716242Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:b3accabaa491d36bd8f08c2c10e0d1bc5b3eecc347fd519e8eb4bec33426e2e4","observation_id":"1bbfc78a-f87f-4e42-a868-01890a07cac1","resolution":{"observed_at":"2026-08-06T16:38:37.526520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":36},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 2 inbound Pith citation observations for arXiv:2507.12977."}