{"as_of":"2026-08-15T12:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1f63b29687889adc17f771c2118f8f1cfd2ef17c27a3ad17d414b26cac8c4898","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T15:21:50.582390Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.01275/citation-record","integrity":"/paper/1908.01275/integrity","json":"/paper/1908.01275/citation-record.json","paper":"/paper/1908.01275"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1906.08879","last_updated":"2019-06-20T22:08:51Z","snapshot_observed_at":"2026-07-06T08:01:50.383586Z","submitted_at":"2019-06-20T22:08:51Z","title":"Placeto: Learning Generalizable Device Placement Algorithms for Distributed Machine Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08879","snapshot_observed_at":"2026-08-14T15:21:50.428466Z","title":"B., Gupta, S., Mao, H., and Alizadeh, M","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.428466Z"},"links":{"cited_paper":"/paper/1906.08879","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:bb34980abb5f3c88c328231c85adbf6201b0b12a70609ba52aad1470e641a2e5","observation_id":"00e02884-7e5a-4207-9575-025b7792fcc5","resolution":{"observed_at":"2026-08-14T15:21:50.428466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.122541Z","title":"Speech recog- nition with deep recurrent neural networks","venue":null,"work_id":"398bfca8-e35e-439e-b255-837e83541096","year":2013},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.455907Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:3a3acb2b087e7698697819a7400a8facf1ec3ccfb75bf17357e57faf84e93403","observation_id":"6e28d589-6bc8-46f8-ab5f-3a54c1d15dc2","resolution":{"observed_at":"2026-08-14T15:21:51.127842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.07926","last_updated":"2017-04-25T22:51:12Z","snapshot_observed_at":"2026-08-14T21:04:43.945304Z","submitted_at":"2017-04-25T22:51:12Z","title":"From Language to Programs: Bridging Reinforcement Learning and Maximum Marginal Likelihood","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.07926","snapshot_observed_at":"2026-08-14T15:21:50.460868Z","title":"Z., and Liang, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.460868Z"},"links":{"cited_paper":"/paper/1704.07926","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:c3c0d38554cf827d0ab74037cf472009d914aeff05c6f62c9dc5af698a13d2bf","observation_id":"228359e0-e55e-4081-8ab8-5bb7f1b6de37","resolution":{"observed_at":"2026-08-14T15:21:50.460868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.01290","last_updated":"2018-08-08T21:27:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-01-04T09:50:50Z","title":"Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.01290","snapshot_observed_at":"2026-08-14T15:21:50.465908Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforce- ment learning with a stochastic actor","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.465908Z"},"links":{"cited_paper":"/paper/1801.01290","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:7fb471c5cc34a03d40cf25b35921e64b3132d195133e6fcd8bcb51293b1fb48c","observation_id":"3910cf45-f41f-41a6-bafc-b28f6d51451f","resolution":{"observed_at":"2026-08-14T15:21:50.465908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.106085Z","title":"Autophase: Compiler phase-ordering for hls with deep reinforcement learn- ing","venue":null,"work_id":"82ada212-0fba-4499-8a44-a5e25e33398c","year":2019},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.471075Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:abfdc71f346f45f25c05b3edb2f46865ff4d9c7c520e1ee7d3c1ba08695ee64e","observation_id":"22f86071-80f4-4f34-acde-68180cfe3e0f","resolution":{"observed_at":"2026-08-14T15:21:51.111257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.073595Z","title":"Learning- based and data-driven tcp design for memory-constrained iot","venue":null,"work_id":"87ab4352-a0d3-4b36-b062-527d6fb2d0c7","year":2016},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.486859Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:13727b73de76046a7f041b7de953cd5678deaef0d7925617bce9b538ec31dfc4","observation_id":"44a93076-ad39-4c38-afd4-a6c552b3e9c3","resolution":{"observed_at":"2026-08-14T15:21:51.079314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.09381","last_updated":"2018-06-29T00:19:24Z","snapshot_observed_at":"2026-08-14T20:00:00.450392Z","submitted_at":"2017-12-26T19:43:59Z","title":"RLlib: Abstractions for Distributed Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.09381","snapshot_observed_at":"2026-08-14T15:21:50.497388Z","title":"Ray rllib: A com- posable and scalable reinforcement learning library.arXiv preprint arXiv:1712.09381,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.497388Z"},"links":{"cited_paper":"/paper/1712.09381","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:d7e901452ae6c8f72859ca4f808b7d079d8f18c96d659b73635b4342b81bfd0f","observation_id":"68442d96-dc64-45ac-8e18-5cbbf335b371","resolution":{"observed_at":"2026-08-14T15:21:50.497388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.10319","last_updated":"2019-02-27T03:24:40Z","snapshot_observed_at":"2026-08-15T11:58:34.210891Z","submitted_at":"2019-02-27T03:24:40Z","title":"Neural Packet Classification","version":1},"cited_work":{"arxiv_id":"1902.10319","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.10319","snapshot_observed_at":"2026-08-14T15:21:50.788059Z","title":"Neural Packet Classification","venue":"cs.NI","work_id":"16b08619-bd29-42a4-ac06-708db2bbfd26","year":2019},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.502401Z"},"links":{"cited_paper":"/paper/1902.10319","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:0b2eafc358e0c2f4abb7c568930bc69897ea9ddbd8f33ca88341f4d104244f37","observation_id":"f883fe50-ff45-4c88-81be-b640f2782c62","resolution":{"observed_at":"2026-08-14T15:21:50.793436Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.03711","last_updated":"2019-04-07T19:00:45Z","snapshot_observed_at":"2026-08-15T02:05:32.819501Z","submitted_at":"2019-04-07T19:00:45Z","title":"Neo: A Learned Query Optimizer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.03711","snapshot_observed_at":"2026-08-14T15:21:50.518247Z","title":"Neo: A learned query optimizer","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.518247Z"},"links":{"cited_paper":"/paper/1904.03711","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:2e1958f71728d89594e238262f46b365819edccad24e55fcb5f9364fd8dd659b","observation_id":"46656035-c6da-4682-83ac-1e2136a7d39c","resolution":{"observed_at":"2026-08-14T15:21:50.518247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-14T03:19:40.736445Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-14T15:21:50.523130Z","title":"Playing atari with deep reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.523130Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:740f27055daaf8fa7b2f0df3de9be67eed1d7d07185164a1c38fe628fbf1a14d","observation_id":"65ba32d6-babe-45d0-b023-20fd4d9ac686","resolution":{"observed_at":"2026-08-14T15:21:50.523130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.023272Z","title":"P., Mirza, M., Graves, A., Lillicrap, T., Harley, T., Silver, D., and Kavukcuoglu, K","venue":null,"work_id":"a16ff760-f955-4d67-896d-65c6a514b45d","year":1928},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.528120Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:e779d0bcdef094485f39087e890211b5bf108e9ba730c4cd6adc2d3b64bbde20","observation_id":"3eade8a4-45eb-46f3-b4b5-7b286ecf3f1b","resolution":{"observed_at":"2026-08-14T15:21:51.029564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04718","last_updated":"2020-04-11T05:57:36Z","snapshot_observed_at":"2026-08-14T18:16:34.155333Z","submitted_at":"2018-10-10T19:20:36Z","title":"A Stochastic Approximation Approach for Foresighted Task Scheduling in Cloud Computing","version":2},"cited_work":{"arxiv_id":"1810.04718","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.04718","snapshot_observed_at":"2026-08-14T15:21:50.710835Z","title":"A Stochastic Approximation Approach for Foresighted Task Scheduling in Cloud Computing","venue":"cs.DC","work_id":"abbe01c0-2adc-463a-bff8-5a613478fe92","year":2018},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.533011Z"},"links":{"cited_paper":"/paper/1810.04718","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:2ce3dd2375fd708d973e0aefb52822e30256e60c17df3cd01e2d476a960fb66d","observation_id":"6549131c-32b3-4b7a-8ed2-e46873144e3f","resolution":{"observed_at":"2026-08-14T15:21:50.718986Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.08604","last_updated":"2018-03-22T22:39:32Z","snapshot_observed_at":"2026-08-14T19:33:21.239869Z","submitted_at":"2018-03-22T22:39:32Z","title":"Learning State Representations for Query Optimization with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.08604","snapshot_observed_at":"2026-08-14T15:21:50.537780Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.537780Z"},"links":{"cited_paper":"/paper/1803.08604","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:ff450c2f9c3fa44e83e13632770dba92e1f457f159980a629198e99766082bb3","observation_id":"8e44b00e-10fd-41b8-994a-7e5e2f08af8e","resolution":{"observed_at":"2026-08-14T15:21:50.537780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.02494","last_updated":"2020-02-10T11:57:18Z","snapshot_observed_at":"2026-08-14T16:36:09.973967Z","submitted_at":"2019-05-07T12:15:06Z","title":"Reinforced Genetic Algorithm Learning for Optimizing Computation Graphs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.02494","snapshot_observed_at":"2026-08-14T15:21:50.542568Z","title":"Regal: Transfer learning for fast optimization of computation graphs","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.542568Z"},"links":{"cited_paper":"/paper/1905.02494","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:a93f672c66deb37d3eda6704a58549b05d013a1d60f581d0d7a3acfd35cb8979","observation_id":"0b3c0038-9114-44d9-9009-fc73b5eb699e","resolution":{"observed_at":"2026-08-14T15:21:50.542568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.004875Z","title":"Semantic locality and context-based prefetching using reinforce- ment learning","venue":null,"work_id":"dbca7139-8823-4cf9-862a-eee7b9d8d4ab","year":2015},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.547836Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:4e929d778f5ee1e88f786dd5e22ed32bd8ea95b14b873b2faec215f1bc2aec96","observation_id":"30458130-2d91-47b1-9a74-eeeeb3009117","resolution":{"observed_at":"2026-08-14T15:21:51.010966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:50.988094Z","title":"P., Obraczka, K., Burleigh, S., and Hirata, C","venue":null,"work_id":"8cb86c59-566e-41cd-851a-1106fc159669","year":2016},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.563366Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:66c6b3b4c265d9a49bee3b82e6a4bf6279299d6a7016159342d200b307fac11c","observation_id":"257fb1fb-ca77-40c9-9dbc-e75de8397943","resolution":{"observed_at":"2026-08-14T15:21:50.993127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:50.971791Z","title":"Machine learning in compiler optimization","venue":null,"work_id":"8d09e080-1e08-48f9-8b41-a29549187f8d","year":1901},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.568188Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:6c63c96e70d7fc14948fbfcee6c3dff4d5a69100a2fbfc4b55ba772554e6207c","observation_id":"ebb2c584-f104-445b-b136-84ff63d22609","resolution":{"observed_at":"2026-08-14T15:21:50.976831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.00103","last_updated":"2017-11-09T23:06:14Z","snapshot_observed_at":"2026-08-03T05:45:09.122112Z","submitted_at":"2017-08-31T23:12:15Z","title":"Seq2SQL: Generating Structured Queries from Natural Language using Reinforcement Learning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.00103","snapshot_observed_at":"2026-08-14T15:21:50.577434Z","title":"Seq2sql: Generating structured queries from natural language using reinforce- ment learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.577434Z"},"links":{"cited_paper":"/paper/1709.00103","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:5b073318b050a813d52979f4a00f47de09a4cf69824917f34874e9be1c5d1e2f","observation_id":"8daf851d-f838-4a05-b827-3c4f25a8cabe","resolution":{"observed_at":"2026-08-14T15:21:50.577434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:50.938775Z","title":"A reinforcement learning approach to automatic error recovery","venue":null,"work_id":"b8e3efc4-807d-4a47-a709-4d95fd0ba597","year":2007},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.582390Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:01666aa78c9ebe0044fb151f4cd1f23f8dd6fc4b7341acdcbf1e2dc1cb4eea2b","observation_id":"6ef79119-f153-434c-99ea-3f3fb5711f02","resolution":{"observed_at":"2026-08-14T15:21:50.943948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-14T15:21:50.558300Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":1999,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.558300Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:1fe314f94521c4dadaa39586be378dc27242c1b41206c17a5f63aa447f95ae22","observation_id":"353e3208-c3f6-4513-a045-991b4a3c2e96","resolution":{"observed_at":"2026-08-14T15:21:50.558300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.138271Z","title":"Energy-efﬁcient virtual machines consolidation in cloud data centers us- ing reinforcement learning","venue":null,"work_id":"02ffa66d-5d79-41cd-9c69-90945c3f12fc","year":2014},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.445112Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:432d9216391f74331065743289e620247588e89c4ca04894479eacd253b9f2a4","observation_id":"ce5c9204-5520-4d21-ab6d-857cba63bb6b","resolution":{"observed_at":"2026-08-14T15:21:51.143986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.03196","last_updated":"2019-01-10T20:33:48Z","snapshot_observed_at":"2026-08-14T18:42:58.580322Z","submitted_at":"2018-08-09T15:30:06Z","title":"Learning to Optimize Join Queries With Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.03196","snapshot_observed_at":"2026-08-14T15:21:50.481128Z","title":"Learning to optimize join queries with deep reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.481128Z"},"links":{"cited_paper":"/paper/1808.03196","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:61a0f72a6527d5d2f70bd47f9276e018d93154e38c04a1f77fad561c1634b6d1","observation_id":"dd34cad1-ffdd-4823-b017-c9bc726f552f","resolution":{"observed_at":"2026-08-14T15:21:50.481128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.090622Z","title":"M., Pahl, C., Metzger, A., and Estrada, G","venue":null,"work_id":"3c24d9ed-5947-448a-b26a-ebf4edbbb5b2","year":2015},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.476129Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:26aa5dd8f672f33247a5547f8ba88ff8100efc8b2e67c7d74d9908c04e398383","observation_id":"dca263bd-c607-4c3f-84da-2ad2d4d02024","resolution":{"observed_at":"2026-08-14T15:21:51.095317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.09975","last_updated":"2018-12-24T19:48:42Z","snapshot_observed_at":"2026-08-15T11:57:33.851057Z","submitted_at":"2018-12-24T19:48:42Z","title":"Iroko: A Framework to Prototype Reinforcement Learning for Data Center Traffic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.09975","snapshot_observed_at":"2026-08-14T15:21:50.553187Z","title":"Iroko: A framework to prototype reinforcement learning for data center trafﬁc control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.553187Z"},"links":{"cited_paper":"/paper/1812.09975","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:f3b556391c4cc748adcca2c086ccea07d8d1c3b7d9b0dd6cfad6085b5ce15b1e","observation_id":"3f65f03d-e9c0-4e6b-8269-d58db559c0ac","resolution":{"observed_at":"2026-08-14T15:21:50.553187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:50.955829Z","title":null,"venue":null,"work_id":"6c0d4c4e-d781-4a54-910e-44f4d18e28e4","year":2017},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.572810Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:6f6fa42e5f3ba1ebe1f7824f705d0052d131be64c31591f8e8453dfc30d65690","observation_id":"621689b6-c168-4c04-97de-037d4b72e670","resolution":{"observed_at":"2026-08-14T15:21:50.960793Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:51.041763Z","title":"A hierarchical framework of cloud resource allo- cation and power management using deep reinforcement learning","venue":null,"work_id":"2d60082d-9073-4d92-aa00-4f9329c3b375","year":2017},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.512996Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:d7318ff56714d379ec253cdb0959e8cb3e695f7994843e8bec54054f1263bcbf","observation_id":"85855dde-fd10-4204-9fbf-a17f6c1e966d","resolution":{"observed_at":"2026-08-14T15:21:51.047557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.00260","last_updated":"2019-09-04T19:30:00Z","snapshot_observed_at":"2026-08-14T19:23:21.694743Z","submitted_at":"2018-11-01T07:02:45Z","title":"Horizon: Facebook's Open Source Applied Reinforcement Learning Platform","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.00260","snapshot_observed_at":"2026-08-14T15:21:50.450088Z","title":"Horizon: Facebook’s open source applied reinforcement learning platform","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.450088Z"},"links":{"cited_paper":"/paper/1811.00260","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:c2518f9a55de21fd43d408a49a4446750258b0b75a2ab95cbd4ca1fc0dd85c16","observation_id":"5ce10ee3-c0b1-47f6-9238-b612a0de9e03","resolution":{"observed_at":"2026-08-14T15:21:50.450088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.00020","last_updated":"2017-04-23T07:16:13Z","snapshot_observed_at":"2026-08-14T21:32:35.593793Z","submitted_at":"2016-10-31T20:07:23Z","title":"Neural Symbolic Machines: Learning Semantic Parsers on Freebase with Weak Supervision","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.00020","snapshot_observed_at":"2026-08-14T15:21:50.492154Z","title":"D., and Lao, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.492154Z"},"links":{"cited_paper":"/paper/1611.00020","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:7fd29ecbf8c4ab46699dff6b73b7d1a18a85559c534fa217382912391a07ea1a","observation_id":"e67973b2-5a57-4a21-9d62-e75a6d1f27bf","resolution":{"observed_at":"2026-08-14T15:21:50.492154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:21:50.434077Z","title":"Castro, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.434077Z"},"links":{"citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:38db12f051d5527cb41fbd3941954eeeb121c4a7ce280a02631ce009a0520b25","observation_id":"aca0b995-cb4e-4dd7-9516-27df91712d13","resolution":{"observed_at":"2026-08-14T15:21:50.434077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.06110","last_updated":"2018-12-14T19:03:38Z","snapshot_observed_at":"2026-08-14T19:03:45.460809Z","submitted_at":"2018-12-14T19:03:38Z","title":"Dopamine: A Research Framework for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.06110","snapshot_observed_at":"2026-08-14T15:21:50.439294Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.439294Z"},"links":{"cited_paper":"/paper/1812.06110","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:18250303dcb198fdd0e089c151e7449ba46a34e441f7d7d4e117fa0ad3f7d0f4","observation_id":"fe4bf235-4093-4328-a5d4-39a4d09e56f5","resolution":{"observed_at":"2026-08-14T15:21:50.439294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-15T12:04:28.662048Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-14T15:21:50.507654Z","title":"P., Hunt, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-14T15:21:50.507654Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/1908.01275"},"observation_digest":"sha256:cf74f2fc60abc6a0702e243833dcd8204d3bc8c1970d79b8f149891a210ff40c","observation_id":"0020236b-a2b5-42d6-9bfd-54c9f8b01aca","resolution":{"observed_at":"2026-08-14T15:21:50.507654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"1908.01275","last_updated":"2019-09-04T23:13:04Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T11:58:14.514553Z","submitted_at":"2019-08-04T05:55:56Z","title":"A View on Deep Reinforcement Learning in System Optimization"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":2,"verified_fuzzy":11},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:1908.01275."}