{"as_of":"2026-08-10T06:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:52dd0ba540f55f94c9f9b4acb1b0429397ab55d05a678ba4edbd7ac1acd6ffb6","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:33:50.317068Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T22:35:37.040638Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02206","snapshot_observed_at":"2026-08-01T22:35:37.040638Z","title":"Reinforcement learning with data bootstrapping for dynamic subgoal pursuit in humanoid robot navigation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15701","last_updated":"2026-07-17T07:23:54Z","snapshot_observed_at":"2026-08-07T17:58:06.995714Z","submitted_at":"2026-07-17T07:23:54Z","title":"RAVEN: Reinforcement-Adaptive Visibility-Graph Planning for Robust Humanoid Navigation with Collision-Free MPC","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T22:35:37.040638Z"},"links":{"cited_paper":"/paper/2506.02206","citing_paper":"/paper/2607.15701"},"observation_digest":"sha256:3e986916aedbe21ee43dc8b067c879e19c4eb04bb0f29bbee4a98c276f5fdf20","observation_id":"b3964702-4ab5-47bb-ba95-e3886eecbf7c","resolution":{"observed_at":"2026-08-01T22:35:37.040638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02206/citation-record","integrity":"/paper/2506.02206/integrity","json":"/paper/2506.02206/citation-record.json","paper":"/paper/2506.02206"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:57.455223Z","title":"Introduction of the Foot Placement Estimator: A Dynamic Measure of Balance for Bipedal Robotics,","venue":null,"work_id":"59c1a50b-ec63-4425-a7c3-da4b21802db1","year":2007},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:45.982721Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:8488b5b2f430cc798ac0d95e7580b0ba536e59cf7273c807a21c0c3213439344","observation_id":"5e55a5b1-3656-4b35-a091-6a474d898f24","resolution":{"observed_at":"2026-08-07T11:33:57.551834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:57.185280Z","title":"Navigation planning for legged robots in challenging terrain,","venue":null,"work_id":"61b4a866-30f6-4b8a-a1a6-0e5af178622b","year":2016},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:46.067955Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:e3b7e33ff6257dfe7538ff8dad17cb6cccb11f228a67531769caa177bcc6ec93","observation_id":"e184e266-55c1-446f-a646-fa74e451b99a","resolution":{"observed_at":"2026-08-07T11:33:57.306213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:46.171453Z","title":"Optimization-based locomotion planning, estimation, and control design for the atlas humanoid robot,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:46.171453Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:740e0e0712e1522a72466214d673a194766451892fffa54801dd70b278e0b8f5","observation_id":"787cc79f-2b84-4667-857e-08cc2e5eca42","resolution":{"observed_at":"2026-08-07T11:33:46.171453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:56.917037Z","title":"Exact cell decomposition of arrangements used for path planning in robotics,","venue":null,"work_id":"746ffa80-b0bd-438a-a625-9cb40d41b0cb","year":1999},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:46.263030Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:ad70f9578431c59bd83b4ffd647583d142e6d953c6af34e86535822df4a47edf","observation_id":"43d458b8-00df-4988-b1d6-6210be1fec8c","resolution":{"observed_at":"2026-08-07T11:33:57.032791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:56.668222Z","title":"An overview of autonomous mobile robot path planning algorithms,","venue":null,"work_id":"c1f94a8f-0a59-4ca4-bea9-edf242ed6dd9","year":2006},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:46.395990Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:a1f684e6a3d0c5fd93c8de6a5cea60870ef13b1e44e46fc31e640939a52fd893","observation_id":"91759f8a-8b67-4a89-a046-423966bdbc46","resolution":{"observed_at":"2026-08-07T11:33:56.783635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:56.380269Z","title":"Path planning and trajectory planning algorithms: A general overview,","venue":null,"work_id":"903c2952-4da9-4f08-b0e7-69d88f7f37b6","year":2015},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:46.547721Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:0c312e7444997ae6d9774a580d55dcca0b8cf8e07bde98a6ddb50a5eb393fd7b","observation_id":"d231c70e-f21f-46b6-ad9c-740947232dfc","resolution":{"observed_at":"2026-08-07T11:33:56.536460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:56.049237Z","title":"Confidence random tree- based algorithm for mobile robot path planning considering the path length and safety,","venue":null,"work_id":"864298f5-406d-4431-a954-01f1d923d07b","year":2019},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:46.715004Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:2cc7d170bf3dde098c2cda7873e192d0f5c9dbd71f154170a6c21a45d10cfc87","observation_id":"506751ae-76fb-4abb-bdf9-83af3c55f446","resolution":{"observed_at":"2026-08-07T11:33:56.205520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:55.823344Z","title":"Optimization-based motion planning for legged robots,","venue":null,"work_id":"3db66bc9-67a4-4ef9-aa64-40e88c1b51b1","year":2018},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:46.882468Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:2f5172e430e1c6ac1a35cc531d3345b855293e3017b10cc03b93c86495ab7ce9","observation_id":"cccc64f7-cb5b-4dcd-a7eb-6f09f0d3a155","resolution":{"observed_at":"2026-08-07T11:33:55.930491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:55.535636Z","title":"Integrated task and motion planning for safe legged navigation in partially observable environments,","venue":null,"work_id":"afed0956-e20d-4e06-8652-ede437975c28","year":2023},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:46.984997Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:bf85d93876fed4e3821b8f6a2fd48f65976c6829b6d4bc63b422a92264462ca5","observation_id":"1fe19592-9ca4-4e45-b327-3d3130da7bb5","resolution":{"observed_at":"2026-08-07T11:33:55.644239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17347","last_updated":"2024-03-26T03:15:14Z","snapshot_observed_at":"2026-07-06T17:50:39.208397Z","submitted_at":"2024-03-26T03:15:14Z","title":"Unified Path and Gait Planning for Safe Bipedal Robot Navigation","version":1},"cited_work":{"arxiv_id":"2403.17347","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.17347","snapshot_observed_at":"2026-08-07T11:33:50.527082Z","title":"Unified Path and Gait Planning for Safe Bipedal Robot Navigation","venue":"cs.RO","work_id":"81c8cb71-52ad-43fe-86cd-c250bfc99b65","year":2024},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:47.137767Z"},"links":{"cited_paper":"/paper/2403.17347","citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:8e6465b0a459afd46d50dc7195cf67049908c0f5219da2cf8a5337ef4629bda3","observation_id":"185c0dd2-a53c-4d03-9b02-a89681136225","resolution":{"observed_at":"2026-08-07T11:33:50.614740Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:55.289792Z","title":"Fast direct multiple shooting algorithms for optimal robot control,","venue":null,"work_id":"1a972612-4547-48ff-94d1-23fcf4f9e35f","year":2006},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:47.253223Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:2cf26a144aae74c99d0decc624d0b530045eacd6db01d0956bdcb5bec96c9f5c","observation_id":"ee89f1e1-1319-4112-901e-3f9ca352ce98","resolution":{"observed_at":"2026-08-07T11:33:55.421021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:55.008695Z","title":"Using optimization to create self-stable human-like running,","venue":null,"work_id":"c5c938a0-5cb9-48f2-a65a-029868c54fe5","year":2009},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:47.401679Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:bd17b3b51c961f7b669e3c44b309aa6c2ce5bcd8134bdfb88763e23896da7ad8","observation_id":"4a83a47b-1afa-4501-b94b-438e51b99606","resolution":{"observed_at":"2026-08-07T11:33:55.146851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:54.709142Z","title":"Whole-body motion planning with centroidal dynamics and full kinematics,","venue":null,"work_id":"0bd90b9d-f5a4-4091-8c9c-63202cbd0e2d","year":2014},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:47.499247Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:29b005d3b423cd5292252046469edfe0f62b50aba514a5bb3165ba6dbe668dd9","observation_id":"4073e0d1-07d9-4e0d-81eb-8374028d13bf","resolution":{"observed_at":"2026-08-07T11:33:54.878671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:54.455784Z","title":"The 3d linear inverted pendulum mode: A simple modeling for a biped walking pattern generation,","venue":null,"work_id":"9d1ae947-a7c2-4875-9d88-4711efc15bc4","year":2001},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:47.670448Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:ad0a0a344ea8ea8eb9795bbbbcc0768821faa864b2128c8105c543fbf9e331ef","observation_id":"ad922e4f-c540-40af-b183-2aefc9c91cae","resolution":{"observed_at":"2026-08-07T11:33:54.561134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:54.168581Z","title":"Bipedal walking control based on capture point dynamics,","venue":null,"work_id":"fa45419c-cb8c-4beb-ad93-1237c6e99e1c","year":2011},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:47.823455Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:6301ffd68eae024f404ee8dc79835e53b7e368bf2cd389c774ad4d57624500e5","observation_id":"339963da-d9e3-4b9f-8617-f27af015526f","resolution":{"observed_at":"2026-08-07T11:33:54.298431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:53.937074Z","title":"Nonlinear model predictive control for rough-terrain robot hopping,","venue":null,"work_id":"ea2ffa79-8d90-4023-adda-e6c221e9d7e5","year":2012},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:48.004964Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:cccad5c2486eceda268651179dd9ab483476e76cfd38cca2c6b5c9ae15f34bb5","observation_id":"a56aac47-df3a-4a49-aeea-6703e77f7eff","resolution":{"observed_at":"2026-08-07T11:33:54.040334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:48.116002Z","title":"Perceptive locomotion through nonlinear model-predictive control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:48.116002Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:459aed51385fb98c17ab1c98112a3e2a68bee62ba1632595bb7bc520dd27d0be","observation_id":"dbcb9620-946d-467a-9667-d332fcf5a736","resolution":{"observed_at":"2026-08-07T11:33:48.116002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:53.652579Z","title":"Model predictive control for dynamic footstep adjustment using the divergent component of motion,","venue":null,"work_id":"03b60288-f61a-472f-8201-79d6c198e6a6","year":2016},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:48.254270Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:8460cdd4a0f04a1cad7252b1d7d2f54956843bfa5f82663d270369209b3e72f3","observation_id":"c1f7cd1c-0a89-480b-b5ec-f3d9243b81f6","resolution":{"observed_at":"2026-08-07T11:33:53.786744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:48.362816Z","title":"A sequential mpc approach to reactive planning for bipedal robots using safe corridors in highly cluttered environments,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:48.362816Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:ad5fe104d5cebf29dbb0582343902bb448708bcde6535dd3c145100297611767","observation_id":"566d52c9-0baa-45f1-ae10-292bcd563abf","resolution":{"observed_at":"2026-08-07T11:33:48.362816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:53.390426Z","title":"Real-time safe bipedal robot navigation using linear discrete control barrier functions,","venue":null,"work_id":"4c3902ac-b330-4f22-b26b-37ce9ccdd85d","year":2025},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:48.481563Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:08f9f9dc7b7ff1c75b4772af6bb49b36b14d0ff59b4cc81532c1f4817bc79efb","observation_id":"4a85c47e-894c-43b0-a189-b32e9e7d9491","resolution":{"observed_at":"2026-08-07T11:33:53.514967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:48.595799Z","title":"Apprenticeship learning via inverse rein- forcement learning,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:48.595799Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:9374579ac3426291e131b53924bf2d3034e0f87bd8473563d811100745ad4c36","observation_id":"4076a78d-f047-4957-b732-9d468378f1f2","resolution":{"observed_at":"2026-08-07T11:33:48.595799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:53.163026Z","title":"Apprenticeship learning using linear programming,","venue":null,"work_id":"331f959b-6085-4c54-93e5-967de37b32b4","year":2008},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:48.692116Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:dd9abf6ae8d09ba20ce6a9bc373bba2fa032260f97c6b3d173e73948bf0683eb","observation_id":"0a5c7f4f-a9f7-4c4a-bd3d-8e2a1b241ac1","resolution":{"observed_at":"2026-08-07T11:33:53.238377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:48.843022Z","title":"Generative adversarial imitation learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:48.843022Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:68d98d0aee30c2ae7fe2de8cb77c81318aa3893f09fe150683ac70ec76b1bb34","observation_id":"eaa33a93-53ab-4b61-918f-3256a4af3882","resolution":{"observed_at":"2026-08-07T11:33:48.843022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:52.859177Z","title":"Goal-oriented obstacle avoid- ance with deep reinforcement learning in continuous action space,","venue":null,"work_id":"5b79700e-6391-4076-859a-0e00862791bc","year":2020},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:48.937422Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:ca8edcb254cd6ca12dd45ffb225309d910feee4d6ce7c226023d23fd4827faa8","observation_id":"a9d0184d-8bb5-4e04-be9a-4bd07c948efb","resolution":{"observed_at":"2026-08-07T11:33:52.999533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:49.072122Z","title":"Where to go next: Learning a subgoal recommendation policy for navigation in dynamic environments,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:49.072122Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:c5ce9060ecd4a66aee99d412a692cc4d3ed587169969bc275200405a5d924393","observation_id":"32780fab-6113-4503-bb13-19ae90ccba2e","resolution":{"observed_at":"2026-08-07T11:33:49.072122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:52.642516Z","title":"Robot navigation in constrained pedestrian environments using reinforcement learning,","venue":null,"work_id":"5a214949-4393-4649-bb4b-fde9103593b4","year":2021},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:49.185856Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:0daa74203b1acf3e4268b0db004e38839bab479dc0fcfc4787837ed14c77ec16","observation_id":"5cb83d8d-a174-43ae-88c1-8d1898170a7e","resolution":{"observed_at":"2026-08-07T11:33:52.724840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:52.390014Z","title":"A hierarchical deep reinforcement learning framework with high efficiency and generalization for fast and safe navigation,","venue":null,"work_id":"68e6828d-0411-49c8-906b-8e29160505ff","year":2022},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:49.305115Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:139f5019f584b1c2040023cdddc0161a93942c080e708e7be857532375254ded","observation_id":"072de955-c836-4511-9ba6-135d96e9f8a8","resolution":{"observed_at":"2026-08-07T11:33:52.486999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:52.064974Z","title":"Drl-vo: Learning to navigate through crowded dynamic scenes using velocity obstacles,","venue":null,"work_id":"f70a26f3-8c4d-4acd-957e-0a6c64944b40","year":2023},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:49.427620Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:78ee07e28b1f48be23278a553e261b400f0a030916e15a75d1df40f12e7b4d84","observation_id":"b2b485ca-9249-46b1-8473-6464a8bded44","resolution":{"observed_at":"2026-08-07T11:33:52.209570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:51.831966Z","title":"Efficient deep reinforcement learning with imitative expert priors for autonomous driving,","venue":null,"work_id":"370cc653-03e1-445d-979a-0f4f3d7aac95","year":2022},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:49.525766Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:7f27a3e2767f0d3499455e62c7429f8befa7153d6966121f9bda796f83b3fa56","observation_id":"40c9287a-bc88-4cbb-8fe5-282da52f7ce6","resolution":{"observed_at":"2026-08-07T11:33:51.950891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:51.572860Z","title":"Pre-training goal-based models for sample-efficient reinforcement learning,","venue":null,"work_id":"570891b5-3be6-4158-9000-4b69fbc0f66d","year":2024},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:49.640866Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:ed2246f26d109d07c022431003d85f20627c6cc163be30a59ac451e51bb00b80","observation_id":"7a35d118-85a1-466f-952a-eb6c61418154","resolution":{"observed_at":"2026-08-07T11:33:51.691359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:51.292026Z","title":"Deep q- learning from demonstrations,","venue":null,"work_id":"897085f5-f448-4737-bafd-f2014f501ee3","year":2018},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:49.819870Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:0183628075ee2e8ccdbe8250acb19f6f3f5aba498b2ed84b12329d2f9b7f3f8f","observation_id":"80730197-6df9-4edf-a685-df9ee676e76f","resolution":{"observed_at":"2026-08-07T11:33:51.413355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:49.972886Z","title":"Soft actor-critic: Off- policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:49.972886Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:62b7870cd35bbd9ea673477c65b4398388e3a169707e5f1fc2d3e000e8ed95be","observation_id":"9c54604b-f17c-43a5-8cb0-8778ed0b5ecc","resolution":{"observed_at":"2026-08-07T11:33:49.972886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:51.026719Z","title":"Template model inspired task space learning for robust bipedal locomotion,","venue":null,"work_id":"1940e5c7-5690-4a6a-b5da-8f6231f40c63","year":2023},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:50.057744Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:04f123a67f15571e912a4974b745658316301a5fb62f3bfb24c878862b7985a2","observation_id":"5b7a965f-8aab-4297-bc93-4da4edbc2279","resolution":{"observed_at":"2026-08-07T11:33:51.141854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:33:50.738584Z","title":"Conservative q- learning for offline reinforcement learning,","venue":null,"work_id":"42452e19-d0f4-4546-a33b-e18ce57d86a2","year":2020},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:50.168382Z"},"links":{"citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:4650a870fdd878b7356a560614a819d6f8303b93738de9f516e7974fba6fc8a4","observation_id":"e4b73840-65c4-4e0a-94c3-20e761fdb8b3","resolution":{"observed_at":"2026-08-07T11:33:50.895121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T11:33:50.317068Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:50.317068Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.02206"},"observation_digest":"sha256:3e905d86b40cf2bb27f4579b6ec567b34e6c8e1b5d6d7a3387a12109eaf215f0","observation_id":"a809ba34-adc7-45de-8f63-eb05135ab05c","resolution":{"observed_at":"2026-08-07T11:33:50.317068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02206","last_updated":"2025-06-02T19:45:29Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-09T21:16:14.160162Z","submitted_at":"2025-06-02T19:45:29Z","title":"Reinforcement Learning with Data Bootstrapping for Dynamic Subgoal Pursuit in Humanoid Robot Navigation"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":1,"verified_fuzzy":26},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 1 inbound Pith citation observation for arXiv:2506.02206."}