{"as_of":"2026-08-18T20:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:39359f8eb198290195282c6d19c7fe4841adf67f1c190190c3b2cd9cb0a9ff05","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T15:35:45.216969Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.14117/citation-record","integrity":"/paper/2411.14117/integrity","json":"/paper/2411.14117/citation-record.json","paper":"/paper/2411.14117"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:46.011090Z","title":null,"venue":null,"work_id":"f766ce36-3358-448d-bc7b-738b37bde2c4","year":2020},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:44.978107Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:2e996abca2caa2276dee8d0651e2e26041f62d449ebc86df152697cdfd72d90c","observation_id":"8c03c2f1-3955-4a42-bb79-2017de7fbb0e","resolution":{"observed_at":"2026-08-12T15:35:46.015738Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.02057","last_updated":"2019-07-03T17:53:02Z","snapshot_observed_at":"2026-08-12T19:51:32.307910Z","submitted_at":"2019-07-03T17:53:02Z","title":"Benchmarking Model-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.02057","snapshot_observed_at":"2026-08-12T15:35:44.982960Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:44.982960Z"},"links":{"cited_paper":"/paper/1907.02057","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:070d092473818303b471e02e9fbfcbf56873879cdd60742c90126a81ee045027","observation_id":"269ac6e4-6165-43f1-aeb8-afd36f297efe","resolution":{"observed_at":"2026-08-12T15:35:44.982960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.996734Z","title":null,"venue":null,"work_id":"377dc149-d5b0-4e4e-825e-83e1046a99ea","year":2016},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:44.987738Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:c56525c84bfd1c9afe4e5ced30bc7f0f3a944298233df4f4feecc2c143998a8b","observation_id":"f3aef3f4-6a10-4691-89b6-3d9cdf795567","resolution":{"observed_at":"2026-08-12T15:35:46.001132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-12T15:35:44.992299Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:44.992299Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:4580aa3a81247224b576d6cec8ba2c77cf7b65cf7aac8508ea6de9ca5431c78c","observation_id":"3ab944f9-6c9e-460a-a8c4-d0f3b13af426","resolution":{"observed_at":"2026-08-12T15:35:44.992299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.982622Z","title":null,"venue":null,"work_id":"8cd8aadf-91ef-4e32-8a6e-d9a1d138b865","year":2020},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:44.996868Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:b7944e9fa0bf494e60c6500c1ab57e7d654c6a6fefc49c5f3e660ca15766a1e2","observation_id":"6fb764a1-469d-4907-a2f4-d29679e71365","resolution":{"observed_at":"2026-08-12T15:35:45.986964Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.001120Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.001120Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:94727619568b15fc9a5ebc972702d6cace23fc2a18eac221b42019df99b02cb8","observation_id":"e131744a-38b5-4932-8178-37e7e972ae9e","resolution":{"observed_at":"2026-08-12T15:35:45.001120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-17T17:19:33.060917Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-12T15:35:45.005915Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.005915Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:28c366efe960f9c037fa1e956fd430d673c55494693e02fbddaeaba66e372fe9","observation_id":"bafc96b3-882d-48d0-be22-3ff938456992","resolution":{"observed_at":"2026-08-12T15:35:45.005915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.010427Z","title":"Haarnoja, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.010427Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:009b43f8cfc80cc8bd12531db0779d5631103e6cea29c89afc40a7cbb86b5e2b","observation_id":"f043b2a2-a197-4e44-890a-2a7bb122a263","resolution":{"observed_at":"2026-08-12T15:35:45.010427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-16T22:06:26.835611Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-12T15:35:45.014552Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.014552Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:f4eab5639d681c8415b419019e649595381b8ad4dc191f4df546f68da26b0a15","observation_id":"93f0eda1-99d7-42e3-9b63-7af122204aea","resolution":{"observed_at":"2026-08-12T15:35:45.014552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.950156Z","title":null,"venue":null,"work_id":"98f95d07-b43a-4a0e-bd12-4d6119272a07","year":2004},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.018974Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:f5cce3c52678a3fb2c7072f4ff188edf5870ef921e673ae4a1c7ae2f59ceb344","observation_id":"731561b1-41cb-4c8d-a126-05d6acc60d60","resolution":{"observed_at":"2026-08-12T15:35:45.954784Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.936053Z","title":"Nagabandi, G","venue":null,"work_id":"15826990-2c7c-4262-8250-87173c8e2fe1","year":2018},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.023032Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:94d23e6ff3386539ec2aac439e844e23cf7751f21e1e58e2f4ce22a6629b3c09","observation_id":"96be4f45-61f8-40b3-a26b-410dbfc1f1d0","resolution":{"observed_at":"2026-08-12T15:35:45.940579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12894","last_updated":"2018-10-30T17:44:42Z","snapshot_observed_at":"2026-08-14T18:06:54.993797Z","submitted_at":"2018-10-30T17:44:42Z","title":"Exploration by Random Network Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.12894","snapshot_observed_at":"2026-08-12T15:35:45.027499Z","title":"Burda, H","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.027499Z"},"links":{"cited_paper":"/paper/1810.12894","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:c53e27ac31bd6a66146f98ec6320b0ae426548d9366bb202908f1dbb318d3901","observation_id":"3adf0fcf-377e-4daf-90b1-24af6a87ef40","resolution":{"observed_at":"2026-08-12T15:35:45.027499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.031956Z","title":"Pathak, P","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.031956Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:a814bd2b8c2522af6da2b3acab36cfa4dc20aede9e17049a0a121c2e8d06208f","observation_id":"899e97a0-3a40-4929-aae6-86dbe05be88b","resolution":{"observed_at":"2026-08-12T15:35:45.031956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.912938Z","title":"Ecoffet, J","venue":null,"work_id":"8c24f1bc-d57b-4c06-9b1f-b4937aa2dc2b","year":2021},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.036048Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:17d418b87039ff753cb25f146ff19fab457b5c1ec61530b8aa463e3873e8712b","observation_id":"d65da31d-fe8e-4f11-b5fe-84737a3f3c1f","resolution":{"observed_at":"2026-08-12T15:35:45.917471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.07607","last_updated":"2021-03-19T01:44:03Z","snapshot_observed_at":"2026-08-16T18:39:12.601255Z","submitted_at":"2021-03-13T03:26:33Z","title":"Solving Compositional Reinforcement Learning Problems via Task Reduction","version":2},"cited_work":{"arxiv_id":"2103.07607","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.07607","snapshot_observed_at":"2026-08-12T15:35:45.428347Z","title":"Solving Compositional Reinforcement Learning Problems via Task Reduction","venue":"cs.LG","work_id":"1fbe8172-c4bc-4322-936c-2f050cd49a15","year":2021},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.040132Z"},"links":{"cited_paper":"/paper/2103.07607","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:30c678b3e0fa736c74d4a73c3c557fff4a196764e4821254872c618e3a19d8b7","observation_id":"c338e191-d828-4787-af7d-8d646381f06a","resolution":{"observed_at":"2026-08-12T15:35:45.434144Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.899103Z","title":null,"venue":null,"work_id":"1a672c97-f285-4330-8653-6cd3963ff504","year":1960},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.044494Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:8eafe643ce840f814ce158386e4948c9c63348076ec8f6864a9b5b5abc356854","observation_id":"4f2e967f-cbd3-4eb3-8a76-bc4fc5ac8653","resolution":{"observed_at":"2026-08-12T15:35:45.903546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.885558Z","title":null,"venue":null,"work_id":"ca57ad45-c98e-4dd0-afcd-824d053aedf9","year":1997},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.048629Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:587f01985614d2d74c025e4d27de731d88cce14c222475735d33bb686c1536cb","observation_id":"8ca60b06-7182-43ac-bd3d-b992b624e733","resolution":{"observed_at":"2026-08-12T15:35:45.889779Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.871640Z","title":"Bengio, O","venue":null,"work_id":"845e1ceb-e559-4187-b752-0e42eb710fdb","year":2005},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.052629Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:432bf2f56e4ead7fa6818e15c05c0b00bc4784a7bc5e3f33f49d103bb759d7fb","observation_id":"ae311b89-b37f-4630-b7e5-cde6f3c8f616","resolution":{"observed_at":"2026-08-12T15:35:45.875883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.856955Z","title":null,"venue":null,"work_id":"f32949e3-6589-4934-9af5-e595906f82e5","year":1995},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.056924Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:48bb6166824b3a7d868ed9bc599bb8db7aa029938a6dfae931f6dbf38e7af29f","observation_id":"c89dde70-772d-49fb-9743-eba132b8e259","resolution":{"observed_at":"2026-08-12T15:35:45.861780Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.842289Z","title":"Arora, P","venue":null,"work_id":"5f7f4112-30ba-45e1-9e70-ec3196708822","year":2021},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.061223Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:2cd2f4f77c7d9309af07d93c506e4e0df0bb88fc4dd2ff7767a80db812c689e5","observation_id":"2cc4c5cf-a95b-4905-bba8-5b637c7f88a3","resolution":{"observed_at":"2026-08-12T15:35:45.846476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-12T15:35:45.065264Z","title":"Levine, A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.065264Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:68fbad27e870eb86fe59becd3559e69a5e01bf2328d54ea2da7bf7fab0b98d6f","observation_id":"c4831cbe-9330-4f15-9d4f-daa58c02f845","resolution":{"observed_at":"2026-08-12T15:35:45.065264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04137","last_updated":"2024-03-14T04:36:31Z","snapshot_observed_at":"2026-08-08T17:26:38.829859Z","submitted_at":"2023-03-07T18:50:03Z","title":"Diffusion Policy: Visuomotor Policy Learning via Action Diffusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04137","snapshot_observed_at":"2026-08-12T15:35:45.069587Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.069587Z"},"links":{"cited_paper":"/paper/2303.04137","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:fb43c6357d81f18c7a7f95f8f97e935f0556a0874fe9f93a97a532d396caca34","observation_id":"812b6d2e-788e-4a73-9deb-d202bd578e94","resolution":{"observed_at":"2026-08-12T15:35:45.069587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03379","last_updated":"2024-05-06T11:33:12Z","snapshot_observed_at":"2026-08-16T16:55:34.524752Z","submitted_at":"2024-05-06T11:33:12Z","title":"Reverse Forward Curriculum Learning for Extreme Sample and Demonstration Efficiency in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03379","snapshot_observed_at":"2026-08-12T15:35:45.074234Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.074234Z"},"links":{"cited_paper":"/paper/2405.03379","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:e95c408414019b24ef59b585501850b9bdf020bc642d3d5098dbb2de2c7297f6","observation_id":"f9041b35-fe36-4577-a0a7-77816c98da68","resolution":{"observed_at":"2026-08-12T15:35:45.074234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.828654Z","title":"Bellemare, S","venue":null,"work_id":"523733cf-8611-4897-bc5c-c49b1e1fa68a","year":2016},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.078620Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:2aaebb8654227a8c1ef6aea8136f1fb0fc12ba6cf311adc2725f3ac767cfa4a1","observation_id":"818814a3-9b32-4c71-be15-00875c91e26b","resolution":{"observed_at":"2026-08-12T15:35:45.832892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.814952Z","title":"Dorigo, M","venue":null,"work_id":"793c9e69-be19-4eb9-909f-948c7ec7dd22","year":1998},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.082705Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:1205f2e59fd7055a8a73fa633107c1fe06a1467da4f9c3e4d6bddf41d46ee841","observation_id":"81f6577c-2e32-4fa2-a14f-763a745c7f9e","resolution":{"observed_at":"2026-08-12T15:35:45.819245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.801157Z","title":null,"venue":null,"work_id":"5b719be0-12c9-4174-9189-89e573f5f3b8","year":1999},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.086908Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:cf5c42cba59585051e58fdf6410500f1b536e0de3c39f968c2fb8d860ed59220","observation_id":"d0c38087-da04-458a-82ca-29ec07182890","resolution":{"observed_at":"2026-08-12T15:35:45.805769Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.05397","last_updated":"2016-11-16T18:21:29Z","snapshot_observed_at":"2026-08-17T16:01:56.839157Z","submitted_at":"2016-11-16T18:21:29Z","title":"Reinforcement Learning with Unsupervised Auxiliary Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.05397","snapshot_observed_at":"2026-08-12T15:35:45.091302Z","title":"Jaderberg, V","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.091302Z"},"links":{"cited_paper":"/paper/1611.05397","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:9c114a3db3e330d5f5298f4a4d964c72ee8b7fc8737fd77a3289334013032aa2","observation_id":"4b334c15-c2de-4cde-96cf-d0ed9e6ca2d1","resolution":{"observed_at":"2026-08-12T15:35:45.091302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.15191","last_updated":"2021-10-28T15:07:01Z","snapshot_observed_at":"2026-08-16T17:45:43.534665Z","submitted_at":"2021-10-28T15:07:01Z","title":"URLB: Unsupervised Reinforcement Learning Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.15191","snapshot_observed_at":"2026-08-12T15:35:45.095797Z","title":"Laskin, D","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.095797Z"},"links":{"cited_paper":"/paper/2110.15191","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:150d1822eefb217ff122c505d7e05309ca251a2b9a6e60146a328e3a64130a03","observation_id":"73f7cebe-834c-40db-8fea-5ad3d08731cc","resolution":{"observed_at":"2026-08-12T15:35:45.095797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.787156Z","title":"Hazan, S","venue":null,"work_id":"2d52e3b0-ddf4-4066-bf6e-56d26be6a00f","year":2019},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.099963Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:59bfb82e4b508991406a83315f975eeedf77b3c4a59631357fc204052c47d0d0","observation_id":"3cea27d8-29d7-44a2-9e76-9c735d988da8","resolution":{"observed_at":"2026-08-12T15:35:45.791530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.103881Z","title":"Andrychowicz, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.103881Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:f6b2cda8dc101307cea3f797f585499464148c07a758f12e309cadd25b426c51","observation_id":"1e96a738-59cd-45e2-8bc9-c4cae87786cf","resolution":{"observed_at":"2026-08-12T15:35:45.103881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.764548Z","title":"Nachum, S","venue":null,"work_id":"d3925b37-4323-4963-b360-de9ce9b33991","year":2018},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.108026Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:0be88cf28c63a05ab55acc3bd05ea94a7fb04b5fef946ce1ce1bde6b9fe021f1","observation_id":"8e3e9767-5167-4fc3-9e19-162572bb7a52","resolution":{"observed_at":"2026-08-12T15:35:45.768796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.112044Z","title":"Lakshminarayanan, A","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.112044Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:38ae20fdf0ef2417edbb605d7623ce175fbfa0efd5f114c9c0799689c0c3934b","observation_id":"5e77f476-0863-4ac3-8e15-84e7f838c3e0","resolution":{"observed_at":"2026-08-12T15:35:45.112044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.741981Z","title":"Dimakopoulou, B","venue":null,"work_id":"db8908d8-c2a1-4ee6-a46f-4ec2d6e19754","year":2018},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.116983Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:b8a11db60d6479a109d1d0ee8f78cbbf2b54d245323169b26cc64e584b8fac68","observation_id":"227a36f7-dd76-47be-9473-b94f42c97fd7","resolution":{"observed_at":"2026-08-12T15:35:45.746359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48456/tr-209","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.306066Z","title":null,"venue":null,"work_id":"a66786f6-ecf3-4e75-972d-104706dec7c6","year":1990},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.121210Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:06c85f00d2116b68b3874b0811e12d5978c80c8228aea87d97acb222fcbed70c","observation_id":"b3a435ea-c3ae-4a2b-a07c-62c944574662","resolution":{"observed_at":"2026-08-12T15:35:45.310568Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.727982Z","title":null,"venue":null,"work_id":"d780cc53-cb02-4cd3-a1af-aa8c7afb12a1","year":1995},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.125464Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:ac8d9411f32b721226cd6125f1ead507377fb2fd8a790dcf888d998420889231","observation_id":"ff2d13f0-35f3-408e-8ba4-981e937334ee","resolution":{"observed_at":"2026-08-12T15:35:45.732079Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1088/1742-6596/1706/","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.292221Z","title":"Bahamid, A","venue":null,"work_id":"5dc23e11-16b2-4c27-8d50-9cce3cc78b96","year":2020},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.129834Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:8bcda531cb5773d594bd040ba0291d5c7aa616003002634a2dadcb3524826369","observation_id":"126591c7-f003-406e-a959-1cecb20cf072","resolution":{"observed_at":"2026-08-12T15:35:45.296578Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.713924Z","title":"Kuindersma, R","venue":null,"work_id":"42d70961-449d-4079-b688-cbefb7e314a4","year":2016},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.134001Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:79fce3c120c2305819fac4a83f724f37a65f60afa60d51099fd1345e15cb87a5","observation_id":"61a37186-a39c-4291-b0f9-c0437ea88270","resolution":{"observed_at":"2026-08-12T15:35:45.718381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.11103","last_updated":"2019-06-19T17:40:58Z","snapshot_observed_at":"2026-08-14T17:38:22.641605Z","submitted_at":"2018-12-26T10:07:13Z","title":"Learning to Walk via Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.11103","snapshot_observed_at":"2026-08-12T15:35:45.137994Z","title":"Haarnoja, S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.137994Z"},"links":{"cited_paper":"/paper/1812.11103","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:162d3e3bb83e617658b85b1b5fe3457be81a2a995eee076edb9b141ff95125cf","observation_id":"d48c30cf-93be-4c67-9b7f-8c95c882bd28","resolution":{"observed_at":"2026-08-12T15:35:45.137994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.700243Z","title":null,"venue":null,"work_id":"568e0e0e-801f-48af-b018-c1647c73f6cb","year":2021},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.142190Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:e83d66a613c6f51ea28c21e394f2c138de2e2c4525d918e6add8222c9287f7fa","observation_id":"fa0e5d3a-bf8e-40b1-befb-787cb2f5abb9","resolution":{"observed_at":"2026-08-12T15:35:45.704811Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.685810Z","title":null,"venue":null,"work_id":"0fc639f1-3f20-4ded-9746-efdcdc18d58d","year":1977},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.146009Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:9e51b8b8e8be42689215a20c114aa607afcebeb11f635aaf3722e4174a85976d","observation_id":"cfe11ae1-9ca8-4d5b-9555-e0f04a428668","resolution":{"observed_at":"2026-08-12T15:35:45.690506Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.670627Z","title":"Frenkel, B","venue":null,"work_id":"1a87b4a0-d6c9-41ce-8c34-1feb63fe8b84","year":1996},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.149903Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:bb37ac49386aa7ae9d85770930040989c983fe91991c89cde57b9eca53bb44ce","observation_id":"32d9f9f5-45d2-4254-a2e2-59ff5548f673","resolution":{"observed_at":"2026-08-12T15:35:45.675332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/9780470141649.ch12","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-13T11:03:48.094449Z","title":null,"venue":"Advances in chemical physics","work_id":"f9db2dad-f51e-4977-8537-0c47514c4313","year":2007},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.153846Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:304978c84e2074dcbd956a15b1e8f8e09b7c7cc91675bec0240fe668e461bf7c","observation_id":"9c7da0f9-0fae-4a53-9827-b2d697117396","resolution":{"observed_at":"2026-08-12T15:35:45.282276Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1080/08927020500035937","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.263105Z","title":null,"venue":null,"work_id":"7b589e56-95ae-4909-b766-56751662d20f","year":2005},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.157841Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:85920c0d034a532cd95ff7c5f843f514b5dc7a13976411ce5f7f2c361f194043","observation_id":"001300a0-ef10-462f-9fe6-376e038fcda8","resolution":{"observed_at":"2026-08-12T15:35:45.267563Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1063/1.475474","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.247910Z","title":null,"venue":null,"work_id":"d03d017e-27ad-4ce6-9fbd-fd1febae193a","year":1998},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.162527Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:15d5171ea3353f59d1aeac54d4b69c7017f1f5781162c75017b5a8b9b6b8a1ec","observation_id":"3eea8772-fede-4fd3-92ef-5c79bb6b89e3","resolution":{"observed_at":"2026-08-12T15:35:45.253645Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.656608Z","title":null,"venue":null,"work_id":"ae10374b-e84f-4de1-b6ce-03ca08767818","year":1998},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.166713Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:72b740c1d8628615c33c50a95abcab4fd6f219f6cc8ed95d4d10c4a7345cc0d5","observation_id":"4cd611dd-c0f8-4de6-a071-fcf49242d54a","resolution":{"observed_at":"2026-08-12T15:35:45.660996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.642932Z","title":"Ahmed, N","venue":null,"work_id":"b1e0c0d6-507f-4f70-840d-3a9cc170086c","year":2019},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.170795Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:b9cca8b52671c57470121e03d415c6406bca47720320ceb5176f82784043b409","observation_id":"8976d82d-876c-463d-b1a5-9ebb31dc8929","resolution":{"observed_at":"2026-08-12T15:35:45.647250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.628991Z","title":null,"venue":null,"work_id":"82e6bc97-68a3-4cf2-9774-d11aec0f1ac8","year":2009},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.174928Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:6ab862aefc92bd724ea906122538264e5e2444e2d55ca2a550722e8ea8495238","observation_id":"76a9b212-5da9-488b-b66d-2a58f19a891b","resolution":{"observed_at":"2026-08-12T15:35:45.633417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.614374Z","title":"Agarwal, N","venue":null,"work_id":"8855a153-731e-4cf6-b054-b9828cd50db0","year":2019},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.179016Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:e0507ec913ab74539c507e635e9d7ab2bd5145e857002153c5ab3080c0fb30f8","observation_id":"39b8f27f-8535-4e4e-bb3a-83c3411630fb","resolution":{"observed_at":"2026-08-12T15:35:45.618821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.183426Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.183426Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:4d30e76a7f8738020101505c7493f5ae7f01d821483319ead74a0c5998897b14","observation_id":"a8050567-252e-4442-8398-b30f69c3d6d6","resolution":{"observed_at":"2026-08-12T15:35:45.183426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.590583Z","title":"Ekroot, T","venue":null,"work_id":"7f0fd45c-0dd4-4bf3-885c-fb0e16e4b5b5","year":1993},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.187605Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:950466f4ad7ce7102af2c596bf0718fb96a70f117455c0f79d04b5e76c67bd79","observation_id":"b657c16e-51ce-4f24-99ad-d3be952b023a","resolution":{"observed_at":"2026-08-12T15:35:45.595447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07798","last_updated":"2017-05-22T15:06:25Z","snapshot_observed_at":"2026-08-14T20:59:03.934741Z","submitted_at":"2017-05-22T15:06:25Z","title":"A unified view of entropy-regularized Markov decision processes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07798","snapshot_observed_at":"2026-08-12T15:35:45.191801Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.191801Z"},"links":{"cited_paper":"/paper/1705.07798","citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:7ae380dd518fe2ab0c7dcb97125567ccf273fee0ab288df8ae6460659b917f89","observation_id":"1c53672a-5b5a-43b3-81a5-d47f8c058c7a","resolution":{"observed_at":"2026-08-12T15:35:45.191801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.576599Z","title":"LeCun, L","venue":null,"work_id":"e333edd6-0bd6-479b-b2c9-0e57d4d09731","year":2002},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.196361Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:7a8e61051af98c150ef4f2b743402e6249183f0c1d2c3f62d44375bbfaebd459","observation_id":"fb8596ec-8ad5-43d1-88fd-16f4909adf4e","resolution":{"observed_at":"2026-08-12T15:35:45.580784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.200395Z","title":null,"venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.200395Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:acd885caa161f6a8a60906b8f8729ef5e189efafd810213c61c32111248bd0b7","observation_id":"932635eb-6c1c-4ca7-99f1-7c760bcc91af","resolution":{"observed_at":"2026-08-12T15:35:45.200395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.553737Z","title":"Bellman, A markovian decision process, Journal of mathematics and mechanics (1957) 679–684","venue":null,"work_id":"0e9393c9-f4a4-48ad-bd63-7521d83c7f3c","year":1957},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.204568Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:3971db3b4ae6951507bf5598d4dd528449e097a9f5ac6db00fb03e051dc563cb","observation_id":"355b5e81-9b96-402a-8e79-43489a7a9955","resolution":{"observed_at":"2026-08-12T15:35:45.558026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.539963Z","title":null,"venue":null,"work_id":"6adb8819-8774-42b8-a3c1-231ccf7ebe17","year":1992},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.208874Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:b92a7e4950ce55523b5372ae4e8cd3a4cc2d8e84f0d91698a3c59a59f45a5240","observation_id":"28262085-fc33-49fe-ae16-b4e8482591d2","resolution":{"observed_at":"2026-08-12T15:35:45.544251Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.525583Z","title":"Amari, Natural gradient works efficiently in learning, Neural com- putation 10 (2) (1998) 251–276","venue":null,"work_id":"78594b68-130d-4915-883c-9a24a329fdd1","year":1998},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.212885Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:fa60ba20c5c83e6b3b2400c4937b87108d03658f4049765640062efc4d9ecda4","observation_id":"a0c2d909-d0da-4548-8d1e-c4120eba3cca","resolution":{"observed_at":"2026-08-12T15:35:45.530692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:35:45.511456Z","title":"∞X i=1 γi−1r(si, ai) s0=s,a0=a # , (A.4) which is termed in RL as","venue":null,"work_id":"4ef0f02e-bdce-439c-9dbb-04da4afd2356","year":2011},"citing_paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T15:35:45.216969Z"},"links":{"citing_paper":"/paper/2411.14117"},"observation_digest":"sha256:480fab15dbf619110a289b8b9db6a4637e7455ecb20ccb15b6d9c7260b414914","observation_id":"d668816b-529a-4907-85ba-4712fa1615a1","resolution":{"observed_at":"2026-08-12T15:35:45.515925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.14117","last_updated":"2024-11-21T13:34:36Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T22:31:41.097251Z","submitted_at":"2024-11-21T13:34:36Z","title":"Umbrella Reinforcement Learning -- computationally efficient tool for hard non-linear problems"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":5,"verified_fuzzy":18},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2411.14117."}