{"as_of":"2026-08-17T23:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:943da33e0ac78e492ff481d4b3853fa21bf285837dd1f0f36f2f9b322dba3640","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:20:03.392082Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.13241/citation-record","integrity":"/paper/2504.13241/integrity","json":"/paper/2504.13241/citation-record.json","paper":"/paper/2504.13241"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:20:04.003705Z","title":"The goal is to iteratively updateθ such that trajectories generated from the current policyq(τ) match the expert demonstrations","venue":null,"work_id":"3aafcf77-e7c3-4ac9-acda-865ea870de85","year":2012},"citing_paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning","version":6},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T12:20:03.392082Z"},"links":{"citing_paper":"/paper/2504.13241"},"observation_digest":"sha256:5fb193d109e217ae4b9195fbe21bb93c0bb0ee7e22089d2e6fd0ca36dad0a916","observation_id":"f244a49c-5dc1-4a4d-b9be-0e79f88fac94","resolution":{"observed_at":"2026-08-16T12:20:04.011525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:20:04.041898Z","title":null,"venue":null,"work_id":"338b007d-b5fd-4507-a026-8d94c969646d","year":2000},"citing_paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning","version":6},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T12:20:03.381251Z"},"links":{"citing_paper":"/paper/2504.13241"},"observation_digest":"sha256:aa28545743ff410fed55a99a83eed09f2faa05e76b13cae66d8da9839366ba01","observation_id":"b186050c-96f6-4818-a2fb-477cacb507f6","resolution":{"observed_at":"2026-08-16T12:20:04.061660Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:20:04.257515Z","title":"Jeffrey Humpherys, Preston Redd, and Jeremy West","venue":null,"work_id":"671bcab7-b363-4699-810c-704c1a8c6fe7","year":2025},"citing_paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning","version":6},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T12:20:03.238615Z"},"links":{"citing_paper":"/paper/2504.13241"},"observation_digest":"sha256:cde5212bac1422d6abe63e5d6ec17a7ad72f18ce68ab2fd1d6888d571d8ff30b","observation_id":"a896ca1d-1c40-46bb-90d6-897b82d2ee12","resolution":{"observed_at":"2026-08-16T12:20:04.272218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:20:04.156030Z","title":"Online inverse reinforcement learning for systems with disturbances","venue":null,"work_id":"ced1b598-cf1e-4371-aa6b-e3e313c7a5bd","year":1922},"citing_paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning","version":6},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T12:20:03.300432Z"},"links":{"citing_paper":"/paper/2504.13241"},"observation_digest":"sha256:b8a21b90ed48d71ffaf7b915dc34b3992a98859ce1b406bfaa23a1f326c2af82","observation_id":"78a9469f-c463-45c0-bebf-e411e66ddebd","resolution":{"observed_at":"2026-08-16T12:20:04.167196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:20:04.093376Z","title":"MPPIis a probabilistic model predictive control policy that estimates an optimal action distribution that minimizes an agent’s objective cost function","venue":null,"work_id":"b660e388-f443-46ce-ac22-ac5ce0de4bce","year":2021},"citing_paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning","version":6},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T12:20:03.372490Z"},"links":{"citing_paper":"/paper/2504.13241"},"observation_digest":"sha256:745235bcd46a9e9a743065bfcc1514c573f559116021bc93ce007bf7c270751e","observation_id":"afa43436-d8ea-44fc-b3ac-f0fb70a626ef","resolution":{"observed_at":"2026-08-16T12:20:04.113106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.11108","last_updated":"2019-09-25T18:44:47Z","snapshot_observed_at":"2026-08-16T23:44:42.301317Z","submitted_at":"2019-05-27T10:29:31Z","title":"SQIL: Imitation Learning via Reinforcement Learning with Sparse Rewards","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.11108","snapshot_observed_at":"2026-08-16T12:20:03.259640Z","title":"Sqil: Imitation learning via reinforcement learning with sparse rewards.arXiv preprint arXiv:1905.11108,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning","version":6},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-16T12:20:03.259640Z"},"links":{"cited_paper":"/paper/1905.11108","citing_paper":"/paper/2504.13241"},"observation_digest":"sha256:f1e808221e62a7577bd193967ecd408f77cd7502910abc36412bff9ef515501e","observation_id":"ab6a0f7b-7ddd-4060-88fd-aca3bcde2b6e","resolution":{"observed_at":"2026-08-16T12:20:03.259640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-13T12:26:05.192883Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-16T12:20:03.198564Z","title":"Openai gym.arXiv preprint arXiv:1606.01540,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning","version":6},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-16T12:20:03.198564Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2504.13241"},"observation_digest":"sha256:ab8fb0f3463544299396bbef1e30c7f749e2eb052d8c6f159806a9283649865f","observation_id":"763c74e1-7e11-4641-a20f-acd65dd55736","resolution":{"observed_at":"2026-08-16T12:20:03.198564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18999","last_updated":"2025-05-18T19:10:06Z","snapshot_observed_at":"2026-08-16T13:48:15.108581Z","submitted_at":"2024-05-29T11:25:53Z","title":"Continuously Optimizing Radar Placement with Model Predictive Path Integrals","version":3},"cited_work":{"arxiv_id":"2405.18999","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.18999","snapshot_observed_at":"2026-08-16T12:20:03.731695Z","title":"Continuously Optimizing Radar Placement with Model Predictive Path Integrals","venue":"stat.AP","work_id":"36664ad0-00f0-43ad-bf86-aa4624fd41cc","year":2024},"citing_paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning","version":6},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-16T12:20:03.247932Z"},"links":{"cited_paper":"/paper/2405.18999","citing_paper":"/paper/2504.13241"},"observation_digest":"sha256:402e166b8302b7218a59e74f0960f66dd94a97f2ae5c1fcb4716b59e00d4aec6","observation_id":"4ec0c19e-d124-4f08-8fed-fcef40dea3cc","resolution":{"observed_at":"2026-08-16T12:20:03.744727Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.03852","last_updated":"2016-11-25T08:09:55Z","snapshot_observed_at":"2026-08-14T21:30:48.662143Z","submitted_at":"2016-11-11T20:53:45Z","title":"A Connection between Generative Adversarial Networks, Inverse Reinforcement Learning, and Energy-Based Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.03852","snapshot_observed_at":"2026-08-16T12:20:03.214955Z","title":"A connection between generative adversarial networks, inverse reinforcement learning, and energy-based models.arXiv preprint arXiv:1611.03852, 2016a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning","version":6},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-16T12:20:03.214955Z"},"links":{"cited_paper":"/paper/1611.03852","citing_paper":"/paper/2504.13241"},"observation_digest":"sha256:a27e352b2d3ae91a3747e3da774424a3772c77d99ccaae39e962743df4afbb4e","observation_id":"5b5497a5-de0e-4429-a024-8ca0c69be37c","resolution":{"observed_at":"2026-08-16T12:20:03.214955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.07742","last_updated":"2019-02-20T19:22:00Z","snapshot_observed_at":"2026-08-14T17:13:38.114869Z","submitted_at":"2019-02-20T19:22:00Z","title":"From Language to Goals: Inverse Reinforcement Learning for Vision-Based Instruction Following","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.07742","snapshot_observed_at":"2026-08-16T12:20:03.226414Z","title":"From language to goals: Inverse reinforcement learning for vision-based instruction following.arXiv preprint arXiv:1902.07742,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning","version":6},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-16T12:20:03.226414Z"},"links":{"cited_paper":"/paper/1902.07742","citing_paper":"/paper/2504.13241"},"observation_digest":"sha256:d1e9e76d896566b31526874ce58e1cd54a1455ab40d93c2f2fefa919312370fb","observation_id":"8b9a2569-c9b5-45c8-8e23-301191a6ae42","resolution":{"observed_at":"2026-08-16T12:20:03.226414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:20:04.193515Z","title":"Bayesian estimation and kalman filtering: A unified framework for mobile robot localization","venue":null,"work_id":"e0a66eab-4a85-450e-a745-c43b17e05c67","year":2000},"citing_paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning","version":6},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-16T12:20:03.277335Z"},"links":{"citing_paper":"/paper/2504.13241"},"observation_digest":"sha256:e834c03791eb0bc8342ee1f468ae707ed61ddaa0e74dc84c5f9ee0c5b77074e6","observation_id":"d00be9b5-f411-44d4-be34-bffd590e94b2","resolution":{"observed_at":"2026-08-16T12:20:04.214465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1507.04888","last_updated":"2016-03-11T11:02:00Z","snapshot_observed_at":"2026-08-15T02:21:02.927164Z","submitted_at":"2015-07-17T09:30:03Z","title":"Maximum Entropy Deep Inverse Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1507.04888","snapshot_observed_at":"2026-08-16T12:20:03.334151Z","title":"Maximum entropy deep inverse reinforce- ment learning.arXiv preprint arXiv:1507.04888,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning","version":6},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-16T12:20:03.334151Z"},"links":{"cited_paper":"/paper/1507.04888","citing_paper":"/paper/2504.13241"},"observation_digest":"sha256:bdda04e783880cf79900798903eeac329be3bcbb05c10ce24672132e9cbda634","observation_id":"872db340-bb6d-481a-98c6-82171a8b552d","resolution":{"observed_at":"2026-08-16T12:20:03.334151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00844","last_updated":"2020-10-20T22:05:50Z","snapshot_observed_at":"2026-08-16T08:40:41.269734Z","submitted_at":"2020-05-02T14:40:18Z","title":"Derivation of a Constant Velocity Motion Model for Visual Tracking","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00844","snapshot_observed_at":"2026-08-16T12:20:03.188403Z","title":"Derivation of a constant velocity motion model for visual tracking.arXiv preprint arXiv:2005.00844,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning","version":6},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T12:20:03.188403Z"},"links":{"cited_paper":"/paper/2005.00844","citing_paper":"/paper/2504.13241"},"observation_digest":"sha256:6e0a8419b86e570953809b946286c38ed26ea3547840989b74e7819e202c6ac0","observation_id":"62a473f0-cdfb-49b9-b22f-7ca461fab91d","resolution":{"observed_at":"2026-08-16T12:20:03.188403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-16T12:20:03.288316Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning","version":6},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T12:20:03.288316Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2504.13241"},"observation_digest":"sha256:52dbe84939b452e6f2852a31d19843c86c1f7489a4013482c30dc4f7928c14c6","observation_id":"ae80fe38-cc57-4aab-8eac-fed48d5e2578","resolution":{"observed_at":"2026-08-16T12:20:03.288316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10841","last_updated":"2024-03-16T07:36:58Z","snapshot_observed_at":"2026-08-16T14:09:14.575234Z","submitted_at":"2024-03-16T07:36:58Z","title":"Extended Kalman Filtering for Recursive Online Discrete-Time Inverse Optimal Control","version":1},"cited_work":{"arxiv_id":"2403.10841","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.10841","snapshot_observed_at":"2026-08-16T12:20:03.499324Z","title":"Extended Kalman Filtering for Recursive Online Discrete-Time Inverse Optimal Control","venue":"eess.SY","work_id":"5f55ea1c-3f36-47d3-93af-2b28a0dc4658","year":2024},"citing_paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning","version":6},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-16T12:20:03.346064Z"},"links":{"cited_paper":"/paper/2403.10841","citing_paper":"/paper/2504.13241"},"observation_digest":"sha256:8719b71d60673d20e2b19bdcd6c299360fe2b5038a05477c4dbe3fe17bdc3d95","observation_id":"73e85a81-d18d-4361-b0b0-d1ecc783786d","resolution":{"observed_at":"2026-08-16T12:20:03.513358Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.13241","last_updated":"2026-07-27T19:57:35Z","latest_version":6,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T12:12:11.144007Z","submitted_at":"2025-04-17T17:39:35Z","title":"Recursive Deep Inverse Reinforcement Learning"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":8,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2504.13241."}