{"as_of":"2026-08-16T09:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b8c1ea7d74ff9cbda6cfc8f52aa81e5620d47d70f7101d1ac9e25215bd5ed86","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T12:40:22.124497Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T21:42:27.858298Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T12:51:23.223053Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.06973","snapshot_observed_at":"2026-08-12T21:42:27.858298Z","title":"Reinforcement learning applications","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2411.08392","last_updated":"2024-11-13T07:24:14Z","snapshot_observed_at":"2026-08-16T00:20:33.026648Z","submitted_at":"2024-11-13T07:24:14Z","title":"RLInspect: An Interactive Visual Approach to Assess Reinforcement Learning Algorithm","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T21:42:27.858298Z"},"links":{"cited_paper":"/paper/1908.06973","citing_paper":"/paper/2411.08392"},"observation_digest":"sha256:630131ab14c836b70a8a7d948b4a89ec833ae5944fbeb9dc1ddddca261ae58f2","observation_id":"bdb219d2-1fad-41b0-82a3-33feeeeb6b2e","resolution":{"observed_at":"2026-08-12T21:42:27.858298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"cited_work":{"arxiv_id":"1908.06973","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1908.06973","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:1908.06973 (2019)","venue":null,"work_id":"612e6d51-463f-4db2-aa14-423d81b2e5b9","year":1908},"citing_paper":{"arxiv_id":"2509.22981","last_updated":"2026-04-07T22:30:08Z","snapshot_observed_at":"2026-08-15T04:18:04.819812Z","submitted_at":"2025-09-26T22:25:16Z","title":"MDP modeling for multi-stage stochastic programs","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-18T12:50:53.853410Z"},"links":{"cited_paper":"/paper/1908.06973","citing_paper":"/paper/2509.22981"},"observation_digest":"sha256:dbcf91a0dca204939765a34a05a20758078f0b3e69bd671cbfdf0d6b30501c3c","observation_id":"2037abcc-700d-4236-a301-d12e794391a3","resolution":{"observed_at":"2026-05-18T12:51:23.226190Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1908.06973/citation-record","integrity":"/paper/1908.06973/integrity","json":"/paper/1908.06973/citation-record.json","paper":"/paper/1908.06973"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:23.037332Z","title":null,"venue":null,"work_id":"a426b945-0081-4cf6-a822-8ec20bc6c401","year":2016},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.835878Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:a04a99759a21793cdaf9b0ec3e63e1930ae64066e802f76149a683e6918acc25","observation_id":"8d5de21e-bc20-4786-9d34-b8ebae94d5e6","resolution":{"observed_at":"2026-08-14T12:40:23.143881Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:23.022981Z","title":null,"venue":null,"work_id":"d713943d-7351-45ed-961c-973e04084971","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.840654Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:9f676d0dd8cd9df7a0187f36f5699cfeb934253f551bef40277c268dbb746459","observation_id":"b2fa2962-081f-4a39-9fed-bf52fec5d31c","resolution":{"observed_at":"2026-08-14T12:40:23.027397Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:23.010030Z","title":"N., Boulanger, A., Powell, W","venue":null,"work_id":"bdcac4b3-b5c6-42da-b3d7-f915d429f4d4","year":2011},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.844744Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:305aba3fdfab79b5196e0ca9892ad211025c1ba259769ac5f9fb3d2af4bafdd3","observation_id":"c8f3c4a1-d936-461f-bf39-694cc2d2a5c9","resolution":{"observed_at":"2026-08-14T12:40:23.014390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.995245Z","title":null,"venue":null,"work_id":"3ac6cdae-e5f8-493c-8f1f-b7252c0512e3","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.848932Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:ec01b32ed0605a5bbe7e3d1b7e358f6b7cd4b6b20e29b2e4bafbdcafd8490d95","observation_id":"3d38c89d-47b9-4574-9e7d-b305f41e835b","resolution":{"observed_at":"2026-08-14T12:40:22.999768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.981923Z","title":null,"venue":null,"work_id":"0bcfdfa8-5be9-4fa0-bb3e-f209f10b81c1","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.853340Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:00488792ee98c5f337d7e1837d5b4815a61d7a54804612e31a41e116a1f0a3c0","observation_id":"3e1bfc83-96f4-4175-a9d3-95943370e7a3","resolution":{"observed_at":"2026-08-14T12:40:22.986506Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:21.857300Z","title":null,"venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.857300Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:bf5e03f43b88731c9a9804050ad49bc6ca2916284979c88a9c42c9f991c2dfee","observation_id":"152e761e-ad3e-4853-86d5-e599c4a0fca2","resolution":{"observed_at":"2026-08-14T12:40:21.857300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.960796Z","title":"and Sandholm, T","venue":null,"work_id":"de97a69b-941b-4855-802e-4ad8d04191c4","year":2017},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.861656Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:a462815e3b5c1b8d0fe4f2f7180b6cbfaa72ee55d18abce395cf28e726ab6b27","observation_id":"fc92b3b2-e268-4b92-af2d-aed8742499f4","resolution":{"observed_at":"2026-08-14T12:40:22.964450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.948902Z","title":"and Murphy, S","venue":null,"work_id":"f27be6b3-dd9e-4148-8121-22176b396977","year":2014},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.865315Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:92b053480e3504edeca82dbfcf099b7ae5ec67e99600a3baf795b5091e987ca9","observation_id":"7a166ae5-5a6a-42ac-be3d-49f7cab8bcef","resolution":{"observed_at":"2026-08-14T12:40:22.953087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.936765Z","title":null,"venue":null,"work_id":"62475821-3320-4022-8504-ef0e170b4070","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.869656Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:901995ef2f45141c602af8253cb0c2d80a43613b6275cb09ff308bb89b46dfc5","observation_id":"87c8fb09-97a5-4a7f-89bc-893b93c06288","resolution":{"observed_at":"2026-08-14T12:40:22.940712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.925613Z","title":null,"venue":null,"work_id":"617cd562-a9e1-442a-923a-636d7e5144fa","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.873447Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:d549b49edbfd6d62c86176b405a393df70cef428715f26cbdc1c1cbc2662b26a","observation_id":"49c9401e-c41b-4b55-a611-ce77a91723e0","resolution":{"observed_at":"2026-08-14T12:40:22.929604Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.913555Z","title":"D., Zoph, B., Mane, D., Vasudevan, V., and Le, Q","venue":null,"work_id":"bdc8294f-008a-4c7e-bb23-1a09d04919af","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.877832Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:c649e19afb57add88db2e458441fd2f6cc2a6d3ba8dc8991958d18dd4eda44c5","observation_id":"9d0bdea4-bb35-468b-a03c-55e8c85e00e0","resolution":{"observed_at":"2026-08-14T12:40:22.917531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.901698Z","title":"B., Zhang, Y., Dilkina, B., and Song, L","venue":null,"work_id":"ca87b837-f1a6-4c39-8c5a-d8bca97e337f","year":2017},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.881878Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:407c226c2d1332821ed4a86371ea1a011e664253065575059c311dfa53a6612a","observation_id":"6c93710f-2311-4fb5-afa5-72068bf68879","resolution":{"observed_at":"2026-08-14T12:40:22.905808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.890477Z","title":null,"venue":null,"work_id":"f8ee1ba1-ecf6-466a-b765-8f6ad5213f57","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.886878Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:98b24c35f822babd73a3d054154255fdac99937cb5d6b481dbc4df99a3ed69e6","observation_id":"463046ca-9592-4bc5-b0c4-dd6c46d9a165","resolution":{"observed_at":"2026-08-14T12:40:22.894293Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:21.890829Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.890829Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:da12be46da8458313b3672997b1f2b7d67e19b9b1fa8979fafcb62e1859ffce3","observation_id":"611742e7-9d6e-4b6e-a341-c34bb13eaaff","resolution":{"observed_at":"2026-08-14T12:40:21.890829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.871823Z","title":null,"venue":null,"work_id":"a6a196b3-1273-449a-b937-247aa20d93d6","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.894404Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:ce772d54b8da32f1f46ab176673b0038c95f002ef10823e7e35884c93ea1a9b9","observation_id":"83826547-c105-4102-b045-01edd474889e","resolution":{"observed_at":"2026-08-14T12:40:22.875582Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.860340Z","title":null,"venue":null,"work_id":"43161fe8-7571-4981-88ab-df072e140a29","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.897820Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:eb23ef67fd3f772c39e991c371bee745b8b54bb4593868ea49fe136ec7887b56","observation_id":"13734b0a-b9f0-4ac9-a31a-2ff2d4068117","resolution":{"observed_at":"2026-08-14T12:40:22.864220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.849789Z","title":null,"venue":null,"work_id":"4a526902-4005-44ab-acd5-3b28b84e5ada","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.901526Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:26465c97bf7bb0a052b5d4ed00b724134a0111b4c6c05ede9830ed37d5065b6c","observation_id":"9e379179-952b-410b-a831-bd7481080418","resolution":{"observed_at":"2026-08-14T12:40:22.853237Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.839465Z","title":null,"venue":null,"work_id":"91ab28a9-c09f-44e1-9edf-150b5cc8c0d9","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.905515Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:01a215274d11d469de8ab4137434431c39d02ad89e8920f445bf8528c2f71560","observation_id":"ae226209-1cad-4794-ace5-5414851737a0","resolution":{"observed_at":"2026-08-14T12:40:22.842992Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.828786Z","title":null,"venue":null,"work_id":"f3f73fc5-80d3-4c57-987f-d6aa9b77d30c","year":2014},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.909206Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:b28dd0acab54e7c495e83941cc93e35047ab7d061e25d91ccbe883632d3ce976","observation_id":"e878ab7e-2116-4779-a4b5-76269e6e3cb4","resolution":{"observed_at":"2026-08-14T12:40:22.832353Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.818203Z","title":null,"venue":null,"work_id":"c2217b02-9baa-444b-ba5f-914cb3a3e760","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.913137Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:2295374f3671f49977910fd57c638ec8a9a2a375b117139f849f2cd8dab1ccd6","observation_id":"7ecc0aad-5d68-4d38-93c7-938bff2ee876","resolution":{"observed_at":"2026-08-14T12:40:22.821842Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.808053Z","title":null,"venue":null,"work_id":"ff52241a-777c-4b82-9955-eef2038d1cb1","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.917458Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:d9a025953a009158ee93284c7d4ce994639421fcfebd2a0dc3b662fb19a8be96","observation_id":"36f2ccea-793f-4dde-8d50-c82a6dd807bd","resolution":{"observed_at":"2026-08-14T12:40:22.811486Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.798256Z","title":"C., Wu, R., Jain, V., and Boutilier, C","venue":null,"work_id":"993243d7-6bae-4ca0-bd88-3b383cbed780","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.921477Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:1079df4a9347d366d0f6d33a7ea6b1a3f260b761e07a50866ebf91181de5479b","observation_id":"c947c9ac-8867-4827-80a5-20001064fc5e","resolution":{"observed_at":"2026-08-14T12:40:22.801740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.787926Z","title":"M., Dunning , I., Marris , L., Lever , G., Garcia Castaneda , A., Beattie , C., Rabinowitz , N","venue":null,"work_id":"2bd921c1-c52d-4030-8d75-55a3b9e0f9d7","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.925088Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:c3e4e167bc7b4c31fe8904e263abc9b8588ac6fdc58a7f72fe1056b199a59b79","observation_id":"1ab8381d-0174-47e9-87f0-4f049fe1c5a1","resolution":{"observed_at":"2026-08-14T12:40:22.791510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.777707Z","title":"and Li, L","venue":null,"work_id":"59112744-6962-48e5-a582-7f97f23670c7","year":2016},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.928971Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:4ce30a914d2ab009d22a8c7271b0ee3f50a55bd16a847041c63eaf37a79cfb77","observation_id":"23d2bfd1-cd5d-4dd7-a138-2e00258ce882","resolution":{"observed_at":"2026-08-14T12:40:22.781324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.766700Z","title":null,"venue":null,"work_id":"3fbfb421-f593-49d2-9e18-0b2f81d51133","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.932389Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:80ceef8bcecc03e67cae388356621db5469611010ba8d9cab909c5615d628dd6","observation_id":"69f3b506-8e13-4a7c-9506-bbf10446b5bd","resolution":{"observed_at":"2026-08-14T12:40:22.770671Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.754955Z","title":"and Nevmyvaka, Y","venue":null,"work_id":"712c2807-9aae-4992-86f9-dfd13a50199b","year":2013},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.936835Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:29e8659641257b9c6ae99d5799c057d3dafa6eabb70546841ae84fd32375b44e","observation_id":"b08465b3-7602-4be9-a3fb-718a85883f7f","resolution":{"observed_at":"2026-08-14T12:40:22.759692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.744613Z","title":"A., and Peters, J","venue":null,"work_id":"a459c70f-9954-46d5-9835-4266a13c69d3","year":2013},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.940438Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:5b46eb384f5f22ceaa6ebcc872fa0c8a179ce4abd533c4e8a953b5e7cb05902a","observation_id":"d9b26ee2-43d7-42e4-8430-f563b90a79e8","resolution":{"observed_at":"2026-08-14T12:40:22.748033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.734285Z","title":"A., Badawi, O., Gordon, A","venue":null,"work_id":"f868fbdf-5ea9-46a7-9067-46ff541f7507","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.944500Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:c37d23630d951fc172554dacd5dec910bd3a5f8f9992e98aa51664486eda8cc8","observation_id":"b4a20137-1cbb-459d-857e-4acbe07c9213","resolution":{"observed_at":"2026-08-14T12:40:22.737886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.724109Z","title":null,"venue":null,"work_id":"c1519f78-7286-45f2-a225-28a52939c692","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.948206Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:b73da5e5013ba9b466148d6e4c90e67174110d77d8fc1481468e749b189d415d","observation_id":"6f874d38-cc30-4629-b337-26c7ede96a1e","resolution":{"observed_at":"2026-08-14T12:40:22.727565Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.712962Z","title":null,"venue":null,"work_id":"3386f5d0-b7f8-47e9-8335-62d40d2193ac","year":2003},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.952701Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:09e40f4a4dfb086196e08d07a702fd66b6086a47ec98ce50c78e6cf82f8de05e","observation_id":"aee0027e-5860-46d2-af57-40112f5b114a","resolution":{"observed_at":"2026-08-14T12:40:22.716518Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.703210Z","title":null,"venue":null,"work_id":"59898b11-5cd9-4492-bfed-8d07ee465348","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.956712Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:18d74bfe53c7455f8f3e4c13ae0a926a993b185fc8e1931960a3f8391b4c7fbc","observation_id":"60879a6e-3d04-42ec-a2c0-6989f4a678c9","resolution":{"observed_at":"2026-08-14T12:40:22.706584Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.693291Z","title":null,"venue":null,"work_id":"c09b4373-3b09-46be-8fe0-ceb0da9af9c9","year":2010},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.960511Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:c9371a3e8522077cdd65da05f531578db83a4ff1f426a0072e6d8aa5f6ae1c73","observation_id":"935d4ba6-33ff-412f-852c-452cece6ea81","resolution":{"observed_at":"2026-08-14T12:40:22.696888Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.682532Z","title":null,"venue":null,"work_id":"06841b34-988f-4d93-b5ac-2f6cc764de63","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.964371Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:dafeee2aadc2bafc0d2662d286a385eacfeb8a3dd7782e607a1cc66fa0f04a9a","observation_id":"551bbf30-c44b-449c-bd3d-1fe010d2b529","resolution":{"observed_at":"2026-08-14T12:40:22.686384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.671782Z","title":null,"venue":null,"work_id":"16d0e765-e8ed-4638-8bc0-edb5fbedd20a","year":2017},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.968244Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:a514e344b7a132540d1760d2b97f17927e0e6bd1838a6c935b71eca4c257d7ce","observation_id":"69313164-da77-4117-9790-87853d0d9ae2","resolution":{"observed_at":"2026-08-14T12:40:22.675488Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.661131Z","title":null,"venue":null,"work_id":"ab5ae32f-2e47-4e93-8e1a-4bdd96c30702","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.972194Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:cb1d53dbde19bac7422c6db93bb1a99e1c0215b7f8110eb57b837743cbd98160","observation_id":"e2dee02a-24b8-4600-933a-1dda564f02fd","resolution":{"observed_at":"2026-08-14T12:40:22.664767Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.649614Z","title":null,"venue":null,"work_id":"23e18c51-0fed-4abd-8993-47031a09e14d","year":2009},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.975980Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:d6c5eaca3ff62800ba9c16def2d7479e415087d89a3b6e3106c4fb7d655e5b3b","observation_id":"fffd76cf-c271-44aa-93de-09c3eedb253e","resolution":{"observed_at":"2026-08-14T12:40:22.653437Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.637026Z","title":"P., Hunt, J","venue":null,"work_id":"4ccaeeab-f0e0-4acd-b5d5-236486baba59","year":2016},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.980023Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:b7f59f28e3421f197980fc83fe8195d81b583b4f8b734ac70707adfb763f0ab8","observation_id":"28c74c6c-6127-4c28-acaa-c43baec39809","resolution":{"observed_at":"2026-08-14T12:40:22.641107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.623319Z","title":"A., Doshi-Velez, F., and Brunskill, E","venue":null,"work_id":"4388b841-75b1-4eef-867a-b2b0797998d4","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.983763Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:65cbd577e551d8bc3f57e274ab96e4580c0f5b36dff4e4fc5b4793ae0bade2fd","observation_id":"ef8a8d04-0d69-4e5e-96d4-94f23a44869f","resolution":{"observed_at":"2026-08-14T12:40:22.627339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.609400Z","title":null,"venue":null,"work_id":"446028aa-ee33-4b69-be1a-2f27cd3b8871","year":2001},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.987398Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:55c4960ec79a8d02823f7dbe8f0e06cac3de8aed2f9e7a2480c38aac96abb8e5","observation_id":"0ded4ecb-a1a6-4a69-b03e-f3bb0c25610d","resolution":{"observed_at":"2026-08-14T12:40:22.613716Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.597312Z","title":null,"venue":null,"work_id":"ac201e32-3a8d-4d60-9d69-6d9097b7db00","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.991323Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:de38e5385115c5e594abd1111007c2e5e95a32ea0762b6b6995aaf509333620d","observation_id":"7bf2e4c9-47c9-4516-b49c-884eb358003c","resolution":{"observed_at":"2026-08-14T12:40:22.601387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.584132Z","title":"B., Meng, Z., and Alizadeh, M","venue":null,"work_id":"79373e65-bc6c-4c66-8f52-e15708387f5c","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.995184Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:8d2a0fc332f896b39f28c32374aa583f2305a1dab106d114ad67ca2af7c3f0d9","observation_id":"da586111-243c-487d-bc91-704f8c62ef57","resolution":{"observed_at":"2026-08-14T12:40:22.588662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.571753Z","title":"V., Steiner, B., Larsen, R., Zhou, Y., Kumar, N., and Mohammad Norouzi, Samy Bengio, J","venue":null,"work_id":"81211e7e-ae17-41ad-94d1-88efa5810aae","year":2017},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:21.999784Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:f5f3fd28d965b1b3d05758a745bd02fefd8aa98021750e4ace36b17e8fc366c0","observation_id":"9f1704ec-0574-4025-ae3b-4fabb80700f2","resolution":{"observed_at":"2026-08-14T12:40:22.575987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.559616Z","title":"P., Mirza, M., Graves, A., Harley, T., Lillicrap, T","venue":null,"work_id":"d0343d13-097b-444b-9752-483f1d8732cd","year":2016},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.003855Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:18fd887c38ac2abad89fa9d28ff8b3ae61af349aac592fb286041323469fa7fc","observation_id":"ff763e50-92fc-4f61-a738-69809879a51f","resolution":{"observed_at":"2026-08-14T12:40:22.563652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.546740Z","title":"A., Veness, J., Bellemare, M","venue":null,"work_id":"987c9d22-ee61-4c8e-9fc2-57402f1613b3","year":2015},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.007717Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:8171261d869fe0646a8e0084b49115216c3cba699b4dd5133f156b62ec7ce256","observation_id":"90e254b6-6f00-4d6e-be6c-f8beb95fd22d","resolution":{"observed_at":"2026-08-14T12:40:22.550798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.534253Z","title":null,"venue":null,"work_id":"dfc1619d-4ba2-4398-a719-f38fb396a8e0","year":2017},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.011865Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:e3e6f7b36a6bb164178fb1dd9f4d3a460436e2122adc18ec32c728589155d4f5","observation_id":"d5ff2226-252c-4e12-9497-7f5f3d972eae","resolution":{"observed_at":"2026-08-14T12:40:22.538362Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.521795Z","title":null,"venue":null,"work_id":"8c0a6233-a49c-442a-be7f-6744f6e03578","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.015521Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:ef77166f0ac470aa1e2b0bef04562294f9e5075d3a1bbbf185a4ced90aad33bf","observation_id":"11fceae3-5e8d-430c-acbc-16722dfaa10d","resolution":{"observed_at":"2026-08-14T12:40:22.525880Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.509173Z","title":"B., Abbeel, P., Levine, S., and van de Panne, M","venue":null,"work_id":"86548df4-9103-4978-be9e-bcb18c895b6f","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.019461Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:9ae7633aedd4f9ba20411c78f9c22235cb3d260f2127a8f10f7cdd449346817c","observation_id":"669d6c9a-ae5e-40f6-a510-21d7c989deaa","resolution":{"observed_at":"2026-08-14T12:40:22.513290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.496790Z","title":null,"venue":null,"work_id":"b6c04cdf-0528-4bbc-a0aa-22c2785d4dba","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.023429Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:98c6caa3f2492e4ddad1e9e7e96144a16ceb5923d82d9793e98e3e589795917c","observation_id":"d442b3c9-1a86-4a0c-ae89-23b10506291d","resolution":{"observed_at":"2026-08-14T12:40:22.500751Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.483485Z","title":null,"venue":null,"work_id":"80a5e140-f881-4071-a5fe-0a3572899ce6","year":2011},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.027261Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:72687a1dc32a89ceb17f7d21275f26dd2524b76aeb2d602623970ada050fe64b","observation_id":"ae1a9668-2511-4862-b250-5379368c4d05","resolution":{"observed_at":"2026-08-14T12:40:22.487743Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.470952Z","title":"and Norvig, P","venue":null,"work_id":"650c2196-080f-4cb3-8891-96b32d0e5505","year":2009},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.030968Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:41ff4bcc7411c5f147f7c6e8e49b1bbdeba872b10d3bc2584d2f8744ea618cbd","observation_id":"f82df0b7-0aec-49f2-b40c-428fc4906453","resolution":{"observed_at":"2026-08-14T12:40:22.474892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.458703Z","title":null,"venue":null,"work_id":"ae441fd1-efa8-4ec5-96ce-91e71b0ad83c","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.034822Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:20f3f8064499f4f6a395ceb50218db2467295a78aeeb99068c9ee8784634b0cf","observation_id":"f1b96dd9-0b2a-4ed6-a5e6-80b9ef7d236e","resolution":{"observed_at":"2026-08-14T12:40:22.462667Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.446319Z","title":"I., and Abbeel, P","venue":null,"work_id":"ab1fdeb5-09a0-477e-933d-e0b94219b4d4","year":2015},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.038541Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:d50cb5318ad60610d36dbc4af582f9f0c79992059a39576a0b1b4e0821bc8498","observation_id":"552ba320-9923-4924-bb6b-7f489d9860f8","resolution":{"observed_at":"2026-08-14T12:40:22.450402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.433796Z","title":null,"venue":null,"work_id":"9a5bc801-7918-470c-838e-2cbfad9ccde8","year":2017},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.042819Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:8afde96f6b6c447709b3525ebac3d5931662072fe0cf585876583dc07f12a494","observation_id":"21c89e61-dc4c-4f16-ab7c-3984f0770d5b","resolution":{"observed_at":"2026-08-14T12:40:22.437659Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.420418Z","title":null,"venue":null,"work_id":"927b7383-3df6-4ec2-a688-61012d0f3b82","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.046595Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:ca9ec57f8cfd361553feea457d494083ee09f9491a0e7e9fc1e225ddc3920563","observation_id":"14305707-00c4-41bf-934d-521c99fdd4b3","resolution":{"observed_at":"2026-08-14T12:40:22.424606Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.407135Z","title":null,"venue":null,"work_id":"89bcb052-6e7c-4075-838d-9ce845c47d50","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.050187Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:c10c8854254f13f7da1f617133652b2369ab71f711edfec75b1e7ff8209f8657","observation_id":"e41f5094-d0de-4b34-9a1b-e5524106dcba","resolution":{"observed_at":"2026-08-14T12:40:22.411163Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.394315Z","title":"J., Guez, A., Sifre, L., Van Den Driessche, G., Schrittwieser, J., Antonoglou, I., Panneershelvam, V., Lanctot, M., et al","venue":null,"work_id":"abf85c16-a353-4d0f-852c-c7659c31da39","year":2016},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.053643Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:9ce5354a9ea7a4a7d5505323f13ae98387bd03f967c8922b9833b92e4e1ba03a","observation_id":"a9f79b30-77eb-4df2-b598-c197cebe5578","resolution":{"observed_at":"2026-08-14T12:40:22.398848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.381427Z","title":null,"venue":null,"work_id":"6d8ee2e8-eb61-4ecb-8a79-a4ac15fa37a3","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.057109Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:27aa84c125ad543f31e8bbd3507edbb404a19ea56b99b603aaec77d21934d5e6","observation_id":"99ccd675-f600-4f5a-a442-aee690179335","resolution":{"observed_at":"2026-08-14T12:40:22.385865Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.369648Z","title":null,"venue":null,"work_id":"144bfc85-7334-44c1-ae89-fd9f4ef68adb","year":2014},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.060456Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:e3500d4202fbfc87fd4c03e9bbd8a3e14b06364dd281b4a0ce23e94fb3feaea0","observation_id":"c45bd6ef-717d-4903-afb1-c216e5295f52","resolution":{"observed_at":"2026-08-14T12:40:22.373349Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.357920Z","title":null,"venue":null,"work_id":"95f48e54-e101-4486-8920-24611df75b4a","year":2017},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.063965Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:faa7079e94428727791b3180b5f4af019912586d4d4ba141f20fc8da58cd43e7","observation_id":"0c233aef-a378-4734-8269-85de0a9cd765","resolution":{"observed_at":"2026-08-14T12:40:22.361675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.345715Z","title":"P., Day, J., George, A","venue":null,"work_id":"2097f28d-6c0a-42fd-8137-c44aaea01205","year":2009},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.067707Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:fd477c5b6ed1b8166b8aeea56e745fad66c3f2376316828eb69a72867f7ecc94","observation_id":"d66b9d3d-020b-4750-9be3-3a42f1c02730","resolution":{"observed_at":"2026-08-14T12:40:22.349653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.333841Z","title":null,"venue":null,"work_id":"6fc6024c-7d5b-401e-b670-dbadc50a40a3","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.071620Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:6641f23c05ccd19443f2dacc4472386c83d744a17978e66fbd8ddff46dd0f7fb","observation_id":"33980519-d9a9-4f0e-953a-30d237173c7f","resolution":{"observed_at":"2026-08-14T12:40:22.337719Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.321793Z","title":"S., Precup, D., and Singh, S","venue":null,"work_id":"1914795b-6bdd-4473-9e9e-117b09f6c5c3","year":1999},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.076311Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:7dec2ef5a03830ee10dcd8d0ce5fee6639c59d4f6bf2d0650ec698a6e4934e53","observation_id":"83261320-9ac4-4fd1-b90c-7489df0920f7","resolution":{"observed_at":"2026-08-14T12:40:22.325787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.309114Z","title":null,"venue":null,"work_id":"c9199775-f288-4a45-94e1-0ea9dc0d122a","year":2010},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.080103Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:e558ff20b9bf3ecd916eb1645a87abcdc01e6b7f41654d9873dec083a062b511","observation_id":"bb7e01f6-400f-4e52-9cd2-d929dc086a4e","resolution":{"observed_at":"2026-08-14T12:40:22.313181Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.297334Z","title":null,"venue":null,"work_id":"fef05f49-e0a9-4be1-9683-57ac0488ec9a","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.083691Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:e44595de668326c94b4c5521044c501ec2e380b5b462b3f1f3af81b8b1315c80","observation_id":"2fcf13ba-386d-4d24-9e08-104980e58208","resolution":{"observed_at":"2026-08-14T12:40:22.301193Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.284627Z","title":"S., and Ghavamzadeh, M","venue":null,"work_id":"4c36e82c-c6d1-4fbb-94ac-7c3a2130158a","year":2015},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.087511Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:09ceafbb9c65ca3624fe000cd95586249538255e2f683085d5a5c934b4018556","observation_id":"790005f3-beaf-4f2c-a2a5-de67ddd9b014","resolution":{"observed_at":"2026-08-14T12:40:22.289421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.272228Z","title":"S., Theocharous, G., and Ghavamzadeh, M","venue":null,"work_id":"be3d50f7-a375-48d9-9625-39ef808e438b","year":2015},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.091088Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:7a35f26a3f6a724d16e45a199548fb1a49bdeaca7381fbe801265c5f76a07efe","observation_id":"df56106d-0007-4937-accd-f38a88acd0ca","resolution":{"observed_at":"2026-08-14T12:40:22.276240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.260125Z","title":null,"venue":null,"work_id":"f338a65a-0832-4e18-8e13-b7324407de38","year":2001},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.094763Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:5f10c37d0618bfe724e0fc26849025f50ee57b87c530247796741ab664ccb0bf","observation_id":"9501534a-3e46-4850-9eef-1a820ba3ab67","resolution":{"observed_at":"2026-08-14T12:40:22.264108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.247658Z","title":null,"venue":null,"work_id":"a95307fd-b6b5-4275-975a-2c018e19cb8f","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.098400Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:10648a60440d358a3b780cddf268c3a6f7b9850af15e0bdf232d4473e609df2d","observation_id":"3228a9ae-9646-4456-8af9-ca74786d28d1","resolution":{"observed_at":"2026-08-14T12:40:22.251524Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.235222Z","title":null,"venue":null,"work_id":"77881a13-800d-483b-aa72-52ab3b2f991a","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.102357Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:b544c22765d55191a7169abec6649f622360f3504b3836e5027bb1910b0ff8ad","observation_id":"dce5b22c-90df-41f0-8994-81c84effbbec","resolution":{"observed_at":"2026-08-14T12:40:22.239243Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.221952Z","title":null,"venue":null,"work_id":"0e430e1c-ecd9-4e82-b04d-078dd0e1134b","year":2019},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.106008Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:97dadf5cab476706b7e547c7b50596b48336c7e54885858c31112412b46b0fb0","observation_id":"273a616b-81b6-4dbe-98b5-191f42ad5805","resolution":{"observed_at":"2026-08-14T12:40:22.226372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.208284Z","title":null,"venue":null,"work_id":"b2f12875-0e62-49aa-902d-572125e5c4e3","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.109716Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:07534152d6b949e01e07b594aa878a853b6ed9f32885a4db082e03814f1165db","observation_id":"d7424efb-79a5-4a34-8a27-6a47e3c6c0c7","resolution":{"observed_at":"2026-08-14T12:40:22.212484Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.195407Z","title":null,"venue":null,"work_id":"3fa4e516-c179-4442-925d-0d6886799da4","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.113277Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:6b235fdb29217ada42a532898d6611fe645d5ed6fe53610bef80d87b5bc1d168","observation_id":"d78c73af-a8cb-40b4-8c84-4a7c07acb80d","resolution":{"observed_at":"2026-08-14T12:40:22.199497Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.181400Z","title":"J., Xie, X., and Li, Z","venue":null,"work_id":"fe1b68b0-c8c1-4d06-bc32-a2ba9430ac67","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.117055Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:ad988a61ef978182837f4e7b9b2287c5fc6f05c8551b5e28d30b133dde8e582f","observation_id":"e7d24ac1-f203-4063-80dc-4f15aaa50656","resolution":{"observed_at":"2026-08-14T12:40:22.185969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.168942Z","title":"and Le, Q","venue":null,"work_id":"3f7a642d-7c92-422f-8d9a-8ea8a6333275","year":2017},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.120901Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:bfa1bf685cf17dfd4c0a8a1edadb7a282d45349eda481919c85ba482e3ecf9e1","observation_id":"d0084f41-d087-455a-8be6-1f0cacb98c3b","resolution":{"observed_at":"2026-08-14T12:40:22.172908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:40:22.154667Z","title":null,"venue":null,"work_id":"85eb64e8-1ca7-45b7-98f8-40e5c106578c","year":2018},"citing_paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-14T12:40:22.124497Z"},"links":{"citing_paper":"/paper/1908.06973"},"observation_digest":"sha256:3cbb10f8e6352bf448f49de3290f686b17a3aa49e9f05fbbfa07e7037ef4c507","observation_id":"5aa186e2-6904-47e4-a8a2-6047b715eacc","resolution":{"observed_at":"2026-08-14T12:40:22.159610Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.06973","last_updated":"2019-08-19T09:47:22Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T06:14:27.328765Z","submitted_at":"2019-08-19T09:47:22Z","title":"Reinforcement Learning Applications"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 2 inbound Pith citation observations for arXiv:1908.06973."}