{"as_of":"2026-08-20T06:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:434e387d682b3039d37bbc664784e8a7f8664fda7cc343526ba9b8ce036f7095","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:46:56.087035Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.10030/citation-record","integrity":"/paper/2507.10030/integrity","json":"/paper/2507.10030/citation-record.json","paper":"/paper/2507.10030"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:46:58.239233Z","title":null,"venue":null,"work_id":"80a1e9fa-8b4e-4f3a-9e76-78246e1e2d91","year":2022},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:53.930010Z"},"links":{"citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:4fa6398841e886c803ba3d5b21540b9b5af0b2a04bb62fe0494b06de3b955448","observation_id":"151c77bb-7b15-4d05-bad5-e0d2c0d18d5b","resolution":{"observed_at":"2026-08-06T17:46:58.347079Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:46:58.105972Z","title":null,"venue":null,"work_id":"435d69ca-ceed-499c-ad8d-3b5c5b08137b","year":2017},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:54.056550Z"},"links":{"citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:2732e6ba35cfa47338781f84dea493de0169af93eee517828f394655f0c0f934","observation_id":"cceebf64-9cfa-4592-90ba-8493f1a70e71","resolution":{"observed_at":"2026-08-06T17:46:58.152433Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:46:57.959790Z","title":null,"venue":null,"work_id":"1c54ccaf-5257-436b-8d44-6df1f95e10b9","year":1996},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:54.202363Z"},"links":{"citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:a541a64ebc5ac934e5e1cd67feb2c6f7d18e74c9d66e6eaf6c61dbf9ea4ae8fb","observation_id":"22b11ab1-2ca6-47b9-b43c-00e08a1e1b45","resolution":{"observed_at":"2026-08-06T17:46:58.016373Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:46:57.814598Z","title":null,"venue":null,"work_id":"d75d2c5a-7bfb-460a-b0fd-8d82c208fe4d","year":2017},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:54.353008Z"},"links":{"citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:1ad0a5565c6434e688f11646d713807ff9aa040b59a89701d9a8a3d6c2b2d7b9","observation_id":"26290483-f9c1-47c2-b2b4-7987d8185b95","resolution":{"observed_at":"2026-08-06T17:46:57.871640Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:46:57.691167Z","title":null,"venue":null,"work_id":"5ab97d9b-3aa9-4271-b56c-77f84fb2acdb","year":2018},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:54.569372Z"},"links":{"citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:60647442da26db93f144f6d1707f337d12dc0dd882a7ad2bea82ba8e52d23fd0","observation_id":"e5d8c68d-e6fd-4b19-8dfb-20e3a19219d1","resolution":{"observed_at":"2026-08-06T17:46:57.740503Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:46:57.547328Z","title":null,"venue":null,"work_id":"051f3240-928c-41ae-88b1-0eeb53adc8c9","year":2018},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:54.713039Z"},"links":{"citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:30255a76b4b467d7e55bf0189dfc0271bf1e3e8eeed4271634504da53649f675","observation_id":"2a195ced-82f7-41bf-b16a-784a9e906295","resolution":{"observed_at":"2026-08-06T17:46:57.596600Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:46:57.420650Z","title":"and Ostermeier, A","venue":null,"work_id":"ca87a4e7-2636-4621-825e-fad786ee1f54","year":2001},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:54.864596Z"},"links":{"citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:92e0b6da01c17a6fb813ea2c3f5ce4146d9d7c26bfab3f57b16e7be790bf6543","observation_id":"78cc31e8-007a-4ec9-a790-1fc287732d83","resolution":{"observed_at":"2026-08-06T17:46:57.466802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-16T22:06:26.835611Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-06T17:46:55.037450Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:55.037450Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:73d4f56623337901b57726ad97644deef17ee13c18e8d6ed8a78e108cecdf3a1","observation_id":"9bfbdc37-3f29-4a93-a8d7-d74f2d7557f8","resolution":{"observed_at":"2026-08-06T17:46:55.037450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:46:57.275488Z","title":null,"venue":null,"work_id":"c87ca85a-37d1-449e-a3b0-89b147c49da0","year":2011},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:55.162891Z"},"links":{"citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:f4d462239afeca10eb5ff1f6da913e98186bb4ba516c3ba47a738013b1e991fb","observation_id":"262d8575-a40b-418e-9b81-32f28c9b0540","resolution":{"observed_at":"2026-08-06T17:46:57.337594Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:46:57.131184Z","title":null,"venue":null,"work_id":"a6111f1c-64d9-4b31-940b-9ef0713d5790","year":2014},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:55.280582Z"},"links":{"citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:5e5836daec3cbbf8de39ddcab8c2959bebd5fcd3c968490435354c5151aed13b","observation_id":"b53a6565-ffc1-4402-824e-88fca967ffd9","resolution":{"observed_at":"2026-08-06T17:46:57.188080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05811","last_updated":"2024-09-09T17:17:25Z","snapshot_observed_at":"2026-08-16T13:20:02.574308Z","submitted_at":"2024-09-09T17:17:25Z","title":"Learning control of underactuated double pendulum with Model-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2409.05811","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.05811","snapshot_observed_at":"2026-08-06T17:46:56.419862Z","title":"Learning control of underactuated double pendulum with Model-Based Reinforcement Learning","venue":"cs.RO","work_id":"4517f3da-bc21-4a7a-9c2a-570a5123c820","year":2024},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:55.421680Z"},"links":{"cited_paper":"/paper/2409.05811","citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:02e14c318fbc0c132b02726fd311028d50ccb6340e1e3d46221c8021dbd78849","observation_id":"34afc2d2-5929-444b-bd8d-ad19acaa85cf","resolution":{"observed_at":"2026-08-06T17:46:56.579644Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:46:56.982755Z","title":null,"venue":null,"work_id":"e6b58afa-586b-4a01-a861-39b2a10dfc9b","year":2022},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:55.580753Z"},"links":{"citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:721f49f23038265cd289ab62c02e16c0ada620d32549c8cc93afcddf97b54057","observation_id":"1dfd7134-5027-475d-ac6d-30d4f937cb7c","resolution":{"observed_at":"2026-08-06T17:46:57.054520Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:46:56.806409Z","title":"ai olympics with realaigym","venue":null,"work_id":"a56ce08f-5b49-4ac6-b9c2-3ba216842e9d","year":2024},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:55.733284Z"},"links":{"citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:bd3b6a5540fc7b6d5761a78b8dff14475343c1d911926d933047c700153e3dd5","observation_id":"77ba26fa-0c23-4a5a-9d39-2b661d0f9e35","resolution":{"observed_at":"2026-08-06T17:46:56.902544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15290","last_updated":"2025-03-19T15:10:02Z","snapshot_observed_at":"2026-08-16T12:48:34.670815Z","submitted_at":"2025-03-19T15:10:02Z","title":"Reinforcement Learning for Robust Athletic Intelligence: Lessons from the 2nd 'AI Olympics with RealAIGym' Competition","version":1},"cited_work":{"arxiv_id":"2503.15290","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.15290","snapshot_observed_at":"2026-08-06T17:46:56.246927Z","title":"Reinforcement Learning for Robust Athletic Intelligence: Lessons from the 2nd 'AI Olympics with RealAIGym' Competition","venue":"cs.RO","work_id":"6931e421-1b7c-4710-9a12-cfcde7344fd2","year":2025},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:55.863568Z"},"links":{"cited_paper":"/paper/2503.15290","citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:dcd57356811d8f5f69b045182a38ff585ec2cee481b3c30d89c9da15c77788d9","observation_id":"64f16195-1003-4f53-b714-de84a2bb7866","resolution":{"observed_at":"2026-08-06T17:46:56.342824Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:46:55.982908Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:55.982908Z"},"links":{"citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:4a6e3c5676659f14379253acb583debd9025f362aab0ed8b97c9923798c743ec","observation_id":"023bd868-5a55-4c62-b4f1-a27a46a1fd89","resolution":{"observed_at":"2026-08-06T17:46:55.982908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:46:56.087035Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T17:46:56.087035Z"},"links":{"citing_paper":"/paper/2507.10030"},"observation_digest":"sha256:50faf9f1e521e32fbd9c35b3a8131c6add7ad8c48bfebf18e8edb04300a90bf7","observation_id":"7df4f830-549d-407b-84f9-ec14d54d096e","resolution":{"observed_at":"2026-08-06T17:46:56.087035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.10030","last_updated":"2025-07-14T08:09:02Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-17T11:42:18.881845Z","submitted_at":"2025-07-14T08:09:02Z","title":"Finetuning Deep Reinforcement Learning Policies with Evolutionary Strategies for Control of Underactuated Robots"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2507.10030."}