{"as_of":"2026-08-10T10:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f9b73479ab1ce835038c7ad5012784b659f82d76cfdb7907d9473977472c0bfc","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:53:53.890488Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T13:36:11.767803Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T04:53:58.087145Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"cited_work":{"arxiv_id":"2507.01691","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.01691","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quantum reinforcement learning in dynamic environments","venue":null,"work_id":"c0badd94-49c9-4d37-97de-84337e8b900c","year":2025},"citing_paper":{"arxiv_id":"2605.20801","last_updated":"2026-07-23T09:23:52Z","snapshot_observed_at":"2026-08-02T13:36:07.666145Z","submitted_at":"2026-05-20T06:45:24Z","title":"Q-SpiRL: Quantum Spiking Reinforcement Learning for Adaptive Robot Navigation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-21T04:50:37.976670Z"},"links":{"cited_paper":"/paper/2507.01691","citing_paper":"/paper/2605.20801"},"observation_digest":"sha256:4ccdd7a46e97f2f4de8f3d410e3bb9cf1682eec0cb9c95b5e2751f57d1c77e20","observation_id":"59b9ada6-54ca-4ecf-b770-98fa0d460cfe","resolution":{"observed_at":"2026-05-21T04:53:58.088564Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01691","snapshot_observed_at":"2026-08-02T13:36:11.767803Z","title":"Quantum reinforcement learning in dynamic environments,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.20801","last_updated":"2026-07-23T09:23:52Z","snapshot_observed_at":"2026-08-02T13:36:07.666145Z","submitted_at":"2026-05-20T06:45:24Z","title":"Q-SpiRL: Quantum Spiking Reinforcement Learning for Adaptive Robot Navigation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T13:36:11.767803Z"},"links":{"cited_paper":"/paper/2507.01691","citing_paper":"/paper/2605.20801"},"observation_digest":"sha256:dcaba744575a357c22b1279b0215d7fcaa995f0a5bc5929dca08bdd7e760acd3","observation_id":"fc056375-29f7-4295-ad73-149d1e28b357","resolution":{"observed_at":"2026-08-02T13:36:11.767803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.01691/citation-record","integrity":"/paper/2507.01691/integrity","json":"/paper/2507.01691/citation-record.json","paper":"/paper/2507.01691"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:58.115617Z","title":", Barreto , A","venue":null,"work_id":"f9c4cb21-7da3-431d-b7dc-ca4b22023ac0","year":2023},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.204165Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:aedc04c7642f47da6febaf0a5f47637f707b52e80aba31deaecf4f74065ee690","observation_id":"353c3696-d164-4c89-a8d3-bc72eeb1ad18","resolution":{"observed_at":"2026-08-06T20:53:58.165576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:49.263694Z","title":", Brassard , G","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.263694Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:fbbb6d9ab5b06e10faf7b5d55fa214a29f836db7ea721d0252ba970779487ac4","observation_id":"955973a7-3e84-4d5b-b378-136d2f67e920","resolution":{"observed_at":"2026-08-06T20:53:49.263694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:49.344854Z","title":", H yer , P","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.344854Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:cc4f9a52192f99a1acf38cef8537b30f3c2e98d0d2cffadc49ae54b45de4c86f","observation_id":"14461d0e-3afb-420c-ad4c-4cfde6f6478e","resolution":{"observed_at":"2026-08-06T20:53:49.344854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/srep00400","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":", Cuevas , G","venue":"Scientific Reports","work_id":"460748b1-be85-4a78-91fa-7b575b545809","year":2012},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.430788Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:778bb42cfa65912e5eb94933fd338e054e4a8cd81145d78cdf9a9c84212da8b0","observation_id":"cc62b7b6-5f73-44e8-a0d3-e069e273b93c","resolution":{"observed_at":"2026-08-06T20:53:55.633462Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:49.498052Z","title":", Arrasmith , A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.498052Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:68f3118693b8529e5a705ade721a8cdc4d4c613a14299db6c85af8cf3e1e9525","observation_id":"2237459c-c656-48c7-ae24-14242d3920ac","resolution":{"observed_at":"2026-08-06T20:53:49.498052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09121","last_updated":"2025-08-25T16:10:12Z","snapshot_observed_at":"2026-08-07T02:29:44.516504Z","submitted_at":"2023-12-14T16:54:57Z","title":"Does provable absence of barren plateaus imply classical simulability?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09121","snapshot_observed_at":"2026-08-06T20:53:49.562993Z","title":", Larocca , M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.562993Z"},"links":{"cited_paper":"/paper/2312.09121","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:0d6102888c834b96a76ca06e6c9bc6257f632faa9538045a6073412c9e757601","observation_id":"029b77e2-f599-4105-8035-db0a7f97ca51","resolution":{"observed_at":"2026-08-06T20:53:49.562993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:49.616688Z","title":", Yang , C.-H.H","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.616688Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:a397277f113bf902b80219cc49ff364e1aed9bca0cc97ebacf3df4f3cb90dd45","observation_id":"d3744512-e590-4679-a5cd-47e66fc515e7","resolution":{"observed_at":"2026-08-06T20:53:49.616688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:49.683869Z","title":", Chang , Y.-J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.683869Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:0adceedcb60b0aaf4b9e70bfa072bee0a3700ba9957e16a066b1bcf49ae88a09","observation_id":"ef5573ed-becf-4741-a15e-2370e3302ac0","resolution":{"observed_at":"2026-08-06T20:53:49.683869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s42484-023-00116-1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":", Kerenidis , I","venue":"Quantum Machine Intelligence","work_id":"3856ad67-80df-4ffd-a16e-f59abe7347f5","year":2023},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.742903Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:d0b30a03730498b7d494566942dec32a41b5a618cb6ecac201253939f2969790","observation_id":"7ab6526e-5e7d-44f3-9d89-b72f76b889d2","resolution":{"observed_at":"2026-08-06T20:53:55.486535Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:57.930320Z","title":", Yeung , D.-Y","venue":null,"work_id":"93589aa6-5d76-4374-817b-29a360765e67","year":1999},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.812620Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:396a9dc544655db30a17f47b0e8b6fa7e8d35a1138f0d4473fa7fcdf02c8d93d","observation_id":"afad38c7-5e8b-4387-9a56-bc120ceefb7c","resolution":{"observed_at":"2026-08-06T20:53:58.027833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:49.892361Z","title":", Rocchetto , A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.892361Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:77a48bc5a919cab4c1e978e23cd36682946c54fe8fd9c28195a79ea3c9bc913a","observation_id":"6c20d084-571f-4c46-9916-d60d1ffd07e6","resolution":{"observed_at":"2026-08-06T20:53:49.892361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:49.947876Z","title":", Meier , U","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:49.947876Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:ea571df71ab9fa6aad5caef58a9c392cd9676d5c71eef46ef0aa16865a774275","observation_id":"62c5b979-489f-4188-baac-00c9f1e5b65e","resolution":{"observed_at":"2026-08-06T20:53:49.947876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:50.027441Z","title":", Buffoni , L","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.027441Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:bc76b448a5b2f054501dd2c509b9c2227fff37e6ed9a328f045f66bea232cfc5","observation_id":"b4bbc6a0-0edf-4414-abba-69a8b0244296","resolution":{"observed_at":"2026-08-06T20:53:50.027441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:50.106694Z","title":", Chen , C","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.106694Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:69abfaaf146f9b71601cb1ba9577fe735e7c75e2afcd21c350424391ee81d4cb","observation_id":"c3212aff-df09-45b1-9da5-5d0d1fab3590","resolution":{"observed_at":"2026-08-06T20:53:50.106694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:50.158504Z","title":", Taylor , J.M","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.158504Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:d0bdf4bbcf54d93cb87ccdf315be2027227d10694e094880e612f09d92f1dcea","observation_id":"782a178f-564d-413f-b78a-09656ed33ad7","resolution":{"observed_at":"2026-08-06T20:53:50.158504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.11160","last_updated":"2018-08-08T18:30:44Z","snapshot_observed_at":"2026-07-06T06:06:51.118611Z","submitted_at":"2017-10-30T18:12:10Z","title":"Exponential improvements for quantum-accessible reinforcement learning","version":3},"cited_work":{"arxiv_id":"1710.11160","doi":null,"metadata_source":"pith","pith_arxiv_id":"1710.11160","snapshot_observed_at":"2026-08-06T20:53:56.598475Z","title":"Exponential improvements for quantum-accessible reinforcement learning","venue":"quant-ph","work_id":"ca52cee3-39f2-47e3-9988-b06394019074","year":2017},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.229737Z"},"links":{"cited_paper":"/paper/1710.11160","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:c23aeb9732eddb67ee5bd8cb6d21a4635bb72d1e3306790cbe4e968221538d90","observation_id":"44f38714-7a9a-4ea5-a902-9f374b1535ab","resolution":{"observed_at":"2026-08-06T20:53:56.660236Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:57.780348Z","title":", Abbeel , P","venue":null,"work_id":"bb4d7764-bcb8-4be9-8dd5-946ae4fd647c","year":2017},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.296449Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:a55dd777d93067dc6b0d3b9ff978535582012ee0f879d0484f56b290368e3d64","observation_id":"b0451e22-e228-41b0-8969-b9c5be9c7662","resolution":{"observed_at":"2026-08-06T20:53:57.868746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08617","last_updated":"2023-02-16T23:01:27Z","snapshot_observed_at":"2026-08-09T21:41:43.762697Z","submitted_at":"2023-02-16T23:01:27Z","title":"Quantum Computing Provides Exponential Regret Improvement in Episodic Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2302.08617","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.08617","snapshot_observed_at":"2026-08-06T20:53:56.479763Z","title":"Quantum Computing Provides Exponential Regret Improvement in Episodic Reinforcement Learning","venue":"cs.LG","work_id":"0ac86a01-f367-46ca-a5b5-ed250583d355","year":2023},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.355747Z"},"links":{"cited_paper":"/paper/2302.08617","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:c37275b49b6af9e8182fe006eb0ef08485fe65f54b79f3d600a4d6d13f046c4d","observation_id":"db3d71df-13c9-46a0-97c4-0eccd66cd76e","resolution":{"observed_at":"2026-08-06T20:53:56.535115Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07072","last_updated":"2025-07-08T08:38:58Z","snapshot_observed_at":"2026-08-10T00:20:44.727204Z","submitted_at":"2024-06-11T08:59:20Z","title":"On the relation between trainability and dequantization of variational quantum learning models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07072","snapshot_observed_at":"2026-08-06T20:53:50.410029Z","title":", Gyurik , C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.410029Z"},"links":{"cited_paper":"/paper/2406.07072","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:2d767810a0b1f76b719d69afa7ed6ef110c4571805da8825aec9a197aa8faf00","observation_id":"2edad1c7-b56f-42f5-8573-ca0a1eccbb5f","resolution":{"observed_at":"2026-08-06T20:53:50.410029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:50.479436Z","title":": Quantum mechanics helps in searching for a needle in a haystack","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.479436Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:c169fc40501030ad34b67bbaf0cc54dfb73b8052146a879d3f697edd38018939","observation_id":"46f4b87a-7b86-4aa0-8164-b2f002be4c5a","resolution":{"observed_at":"2026-08-06T20:53:50.479436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s42484-021-00049-7","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":", Dunjko , V","venue":"Quantum Machine Intelligence","work_id":"df081b2e-6cc1-4fd4-9049-5eef0a7abd7a","year":2021},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.535114Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:b1a3e3a5cd8d7364e0c76a98cfa9abdbd02906d6b1663dd6f3661e737187ed30","observation_id":"b3643d83-f85b-4755-9767-336d5e1a075a","resolution":{"observed_at":"2026-08-06T20:53:55.347003Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1088/1367-2630/ac5b56","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":", W \\\"o lk , S","venue":"New Journal of Physics","work_id":"91ea49ba-ef51-461d-bb04-99a5cc4a5015","year":2022},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.594674Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:0b334dbc69f42bac8a9e5b88edb4a295da89ec7f2c270891c83dd61a4af1ad8a","observation_id":"d7c9e87c-d743-407c-9e3a-c8db73e00879","resolution":{"observed_at":"2026-08-06T20:53:55.198241Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:57.639485Z","title":", Gyurik , C","venue":null,"work_id":"4d2b62fb-2f37-424d-9c71-7e73440197e2","year":2021},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.659248Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:48850af4c44e8713477f052e2f06d08225781554204fe325ea81e1afb71afc54","observation_id":"78d4e288-6e8b-4827-a920-2b06ef1336fd","resolution":{"observed_at":"2026-08-06T20:53:57.712455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1103/prxquantum.2.010328","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":", Trenkwalder , L.M","venue":"PRX Quantum","work_id":"283e6464-e959-4ccd-8e9c-25c08e0428c3","year":2021},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.734170Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:5c745c989a43e5a4e8adb275efc3cf7f5cdfd99149bfbc6c2e588f9bddecd7de","observation_id":"6d5184e5-4433-4925-8af7-488cc76fa548","resolution":{"observed_at":"2026-08-06T20:53:55.036498Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:50.799756Z","title":", Riemer , M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.799756Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:4ba7ccc2815a585b5c13937d8c4c3d1ac0dcd041b63aff363d24cdecbbd16028","observation_id":"6bef48a9-503d-44ff-bee1-3dc25f646107","resolution":{"observed_at":"2026-08-06T20:53:50.799756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:50.884301Z","title":", Sutskever , I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.884301Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:b0b76230b9baa478daa1f6bbdef668c02642393e67b05bb8039efc1c297f4fe9","observation_id":"1674c910-c3aa-4f88-b66a-003d4c04dfb9","resolution":{"observed_at":"2026-08-06T20:53:50.884301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-07-06T18:51:06.750136Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-06T20:53:50.948259Z","title":", Towers , M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:50.948259Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:e8bad33896619384f36a7f88f2c869be78eca61f007f6fae5490f8e47e672bae","observation_id":"d13f9c2f-48eb-4b7c-bcfb-eb1d5920cfda","resolution":{"observed_at":"2026-08-06T20:53:50.948259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-06T20:53:51.000022Z","title":", Hunt , J.J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.000022Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:f0aa54ffba6e8aa8d1ff885bf7f090d8ec076fb01cebb5b8a52ac77224b29349","observation_id":"e95f4ef8-8896-4499-b714-9d3dbe563874","resolution":{"observed_at":"2026-08-06T20:53:51.000022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:51.052747Z","title":", Arunachalam , S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.052747Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:4c75e1f8b7fdcbf57aa1e7e236ebc26cfd85799bc289dfc2dc4b089675791396","observation_id":"7f5fda6e-27e9-439d-9faf-cd33575f6701","resolution":{"observed_at":"2026-08-06T20:53:51.052747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:57.503389Z","title":", Si , M","venue":null,"work_id":"6522750c-98e0-482c-8769-73251ac0b710","year":2020},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.141244Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:067ed74a93496d1963b5fb4dd6af92fe825beeab065ba7381169d333e20cfafb","observation_id":"c2dc4a57-ef15-4a3d-8450-b5bada63572c","resolution":{"observed_at":"2026-08-06T20:53:57.558082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:51.215843Z","title":", Si , M","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.215843Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:cf4b170ec840e5406ff97a7d24df27ef926377df9d24644211f281e1502aa599","observation_id":"9e60453b-79d8-4546-b0d9-cd61ff66bfa5","resolution":{"observed_at":"2026-08-06T20:53:51.215843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00354-015-0102-0","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":", Makmal , A","venue":"New Generation Computing","work_id":"c4b84acf-475f-4d9d-be97-90dbb0503131","year":2015},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.275869Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:faeea8b6520c9a26086bf8275621b2c5ac98118a9aa28a739910508a1113a8f4","observation_id":"a330f1a2-7879-4b16-84de-a7f45176f5fa","resolution":{"observed_at":"2026-08-06T20:53:54.877334Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:51.353953Z","title":", Cohen , N.J","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.353953Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:5ab47f25b87284a0279d3e1149b1afa906202667c22fe5bb95373dfeca327b36","observation_id":"5410c872-e49b-4dc2-b2fe-1e20b5c1ed80","resolution":{"observed_at":"2026-08-06T20:53:51.353953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.28764","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:56.293722Z","title":", Makmal , A","venue":null,"work_id":"d5dc8eab-678b-4bbb-af8a-9652c155e55e","year":2018},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.423143Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:6ff3261f0fca16e9e98fac27e9bdcff6a89b809c84a423b25b271b3aa6365969","observation_id":"e99eca3c-c72c-425a-a24a-704bcf214ea5","resolution":{"observed_at":"2026-08-06T20:53:56.386391Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:51.479576Z","title":", Scherer , D.D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.479576Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:18923b0dbbb921f5662dc688f95572c36d5ad9801c7426236829a85d9240790a","observation_id":"60b8c208-528c-4de4-b8d4-b7569320cf65","resolution":{"observed_at":"2026-08-06T20:53:51.479576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:51.565011Z","title":", Kavukcuoglu , K","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.565011Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:3fe72a5ca58b5fc0ec14f9b6f25bd631e06010175b4757ca41c2a50f6ef40bef","observation_id":"0ee2d3a6-cb7f-4f35-9a87-55a4a4924d4f","resolution":{"observed_at":"2026-08-06T20:53:51.565011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02027","last_updated":"2024-12-20T10:22:48Z","snapshot_observed_at":"2026-08-10T09:11:50.298457Z","submitted_at":"2024-05-03T11:58:43Z","title":"Exponential quantum advantages in learning quantum observables from classical data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02027","snapshot_observed_at":"2026-08-06T20:53:51.652640Z","title":", Gyurik , C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.652640Z"},"links":{"cited_paper":"/paper/2405.02027","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:b440c640ba0ef15dcc3d5f344325d25eccd8d4a1762d3ea81884a76d0763f0cd","observation_id":"f436015a-a989-4c25-9557-b481d162b133","resolution":{"observed_at":"2026-08-06T20:53:51.652640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:51.725748Z","title":": A survey of reinforcement learning algorithms for dynamically varying environments","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.725748Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:cc236c7ff2391da71c9a2d3ddd0b75f0a28b2a1cc7d5880703a0341a3a47ec75","observation_id":"75c4d79f-5ecc-491a-8033-a5cb7c0a2c39","resolution":{"observed_at":"2026-08-06T20:53:51.725748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1103/physrevx.4.031002","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":", Dunjko , V","venue":"Physical Review X","work_id":"26d30162-afee-4eea-9bfb-fde2ace094e0","year":2014},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.787914Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:4104e02238a9d6c903331b4a4547f3175bfda3e35a49ff05c6806b7570098e9f","observation_id":"62f7310b-4f02-4d29-be8e-6a6d63b000b5","resolution":{"observed_at":"2026-08-06T20:53:54.668985Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2016.78493","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:55.983884Z","title":", Wiering , M.A","venue":null,"work_id":"a3087297-48bb-468a-a0f2-e499192ed2b6","year":2016},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.867799Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:a47d9fc811e34162337db9a395c5fb54d20c56e4386ba623295ea920ef7817be","observation_id":"86015ffb-5129-418a-ab5f-49dde5ad5e7d","resolution":{"observed_at":"2026-08-06T20:53:56.044520Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:51.931627Z","title":": Quantum computing in the NISQ era and beyond","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:51.931627Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:d45486109601204ff5bd9610571fd0df989e26096afa9dcce0d6841bcc0dcbfc","observation_id":"ce160d58-29aa-43de-80f4-9384b9087661","resolution":{"observed_at":"2026-08-06T20:53:51.931627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:57.364808Z","title":": Markov Decision Processes: Discrete Stochastic Dynamic Programming , 1st edn","venue":null,"work_id":"4a1ad801-1188-49cf-8ae0-2682022a2238","year":1994},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.006742Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:8bb8c7a013b4c0e710392f8f90c3c6cc4c5850b9248fcbd14f0c6ef3ccdb42fc","observation_id":"e4eed36f-c9ed-4f26-9521-4ec8782e9f28","resolution":{"observed_at":"2026-08-06T20:53:57.423926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:57.228132Z","title":": Continual learning in reinforcement environments","venue":null,"work_id":"87694ea4-3aa3-47d3-8cb7-a404d0e5c1b3","year":1994},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.089925Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:5b903161d94a923670b89e052b39d659e90e8f0b635a5c70a91614b7e4887541","observation_id":"f3c39c8b-79e7-4965-a2ed-312a537115ef","resolution":{"observed_at":"2026-08-06T20:53:57.304850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-021-03242-7","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"o mberg , T. , Schiansky , P. , Dunjko , V. , Friis , N. , Harris , N.C. , Hochberg , M. , Englund , D. , W \\","venue":"Nature","work_id":"84bf5e7d-f93e-4a17-ad12-523160a48094","year":2021},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.157831Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:3959cc8f5c59f1913d001f91f1edbb3025adbe2f4eef02a7bac4e5b112585a84","observation_id":"8e3e1632-3a8a-4d89-894e-15a5fef20b11","resolution":{"observed_at":"2026-08-06T20:53:54.459517Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:52.226743Z","title":", Antonoglou , I","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.226743Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:dcfc5fc0747a1225a6bfee94673f87a9103a55a557ba69693a659964ee130932","observation_id":"e85885c9-174d-49bb-84d1-24f6ec28ff85","resolution":{"observed_at":"2026-08-06T20:53:52.226743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:52.336904Z","title":", Killoran , N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.336904Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:f229c2919ccb96072999c89b02f631d3653e5edfc1f1b5fe3117eabb5d4f632d","observation_id":"6388860c-6b02-4516-8ceb-2979e41349ac","resolution":{"observed_at":"2026-08-06T20:53:52.336904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s42484-025-00269-1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":", W \\\"o lk , S","venue":"Quantum Machine Intelligence","work_id":"ef07dbb5-1e62-40e7-ab6d-5fad02e1392b","year":2025},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.432616Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:60dd9c48ea7b2add3952543e5cdc738589a78f1ffac86684287970baec5a162e","observation_id":"0c9ae239-994e-48b8-a92a-f0e2da881216","resolution":{"observed_at":"2026-08-06T20:53:54.332661Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:52.527616Z","title":": Algorithms for quantum computation: discrete logarithms and factoring","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.527616Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:105de53a994124c5e10f48ee0c86b44d19bc842b847a52a10f2c6d33f5cc8f88","observation_id":"0df5869b-0779-4bf7-8b0d-1bad1f827bdc","resolution":{"observed_at":"2026-08-06T20:53:52.527616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:52.598401Z","title":", Basso , E.W","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.598401Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:8ff939d13ae8fe951ee21a4fc40286bc9a89b6e91dc981520504f1904d3afc23","observation_id":"78abdd38-7987-4232-96df-342d26cc93fc","resolution":{"observed_at":"2026-08-06T20:53:52.598401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:52.682047Z","title":", Jerbi , S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.682047Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:6e8ed87965e4b3bfd283190660eda13b0decfb1fc1786a5ba4593438335a4029","observation_id":"e7c445af-f3d1-490a-a108-1d87e2f1ebaf","resolution":{"observed_at":"2026-08-06T20:53:52.682047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:57.115986Z","title":", Weiss , E","venue":null,"work_id":"2076fd92-1fc2-471a-9dc3-7264c25d35f6","year":2015},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.843181Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:776b32c8cd421daa38bb48d5c4f54e9ed50fb8c293599b08ba792daf00daf361","observation_id":"4e6be170-b738-4e3c-9b5f-c927b012d8a7","resolution":{"observed_at":"2026-08-06T20:53:57.168486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1088/2058-9565/aaef5e","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":", W \\\"o lk , S","venue":"Quantum Science and Technology","work_id":"97d4ab22-60dc-4ae9-8294-272bbbf7cd4b","year":2018},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:52.964122Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:20538b8edf8bf615ce93e31dc2fb4acff2b0cc286fd3e737e2e77fefed4d8803","observation_id":"59147d27-28a7-4caf-9de9-cef62352dade","resolution":{"observed_at":"2026-08-06T20:53:54.199744Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:56.956887Z","title":", Barto , A.G","venue":null,"work_id":"3681dd1e-dd59-43df-b811-4e6cf3766982","year":2018},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.125676Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:6e8217efdad0179bc0349dd0e04b82295e0802816ea17a16e34a918277d2d253","observation_id":"aca432a3-74e6-48a4-96d6-6bda11498163","resolution":{"observed_at":"2026-08-06T20:53:57.029628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:56.853938Z","title":", Shazeer , N","venue":null,"work_id":"5923bc5d-2ec7-4596-b138-1bffde149b02","year":2017},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.264533Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:bca7cea3c1c0eac33ddafa51b54debf0c67a5fb4cdbc105d459d9d3dd89819c3","observation_id":"7d8c3af7-7cf0-4305-b35d-397c0a360eb9","resolution":{"observed_at":"2026-08-06T20:53:56.907107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:53.358936Z","title":", Dayan , P","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.358936Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:1ff0e2cdfc86e80ad376781782ee3abaf56a7ed7b408f26d141a4f1aa15ec941","observation_id":"28b4a498-04c2-4693-9ec1-9ab0f459b858","resolution":{"observed_at":"2026-08-06T20:53:53.358936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04741","last_updated":"2023-05-10T08:36:41Z","snapshot_observed_at":"2026-07-06T13:19:15.758425Z","submitted_at":"2022-06-09T19:23:10Z","title":"Quantum Policy Iteration via Amplitude Estimation and Grover Search -- Towards Quantum Advantage for Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04741","snapshot_observed_at":"2026-08-06T20:53:53.445777Z","title":", Hein , D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.445777Z"},"links":{"cited_paper":"/paper/2206.04741","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:d68edaceaf50f5e3aaf124c180bb5bd98e57113407a8c0d939d2567a7246edaf","observation_id":"16debd30-cc57-4326-94f8-eea268b67d4f","resolution":{"observed_at":"2026-08-06T20:53:53.445777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:53.517354Z","title":": Simple statistical gradient-following algorithms for connectionist reinforcement learning","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.517354Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:ad2b7dd1aa94dba842f5ad1fb58657740034347513d9e36f17e556326486b1af","observation_id":"2cd75ace-30f7-4ae8-9e87-97579b73dc62","resolution":{"observed_at":"2026-08-06T20:53:53.517354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.22331/q-2025-03-12-1660","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":", Jin , S","venue":"Quantum","work_id":"9d84a739-9f61-4ea3-9fe2-6debec7cc1b0","year":2025},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.616842Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:f42c5271498a0b3148501fe525fc1672e1f5f141a13aa02e485a95ad63283007","observation_id":"d65a9081-75b0-42aa-95ec-22759b26015a","resolution":{"observed_at":"2026-08-06T20:53:54.070042Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.10796","last_updated":"2024-06-13T17:00:41Z","snapshot_observed_at":"2026-08-10T01:48:00.453749Z","submitted_at":"2023-02-21T16:23:11Z","title":"Provably Efficient Exploration in Quantum Reinforcement Learning with Logarithmic Worst-Case Regret","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.10796","snapshot_observed_at":"2026-08-06T20:53:53.706900Z","title":", Hu , J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.706900Z"},"links":{"cited_paper":"/paper/2302.10796","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:02b8a347422d8cbd65bd017c311c2b72b252de7dad35381c1e97a5b4d5678c49","observation_id":"ababe30b-1db1-4bb3-947b-19622a51b47c","resolution":{"observed_at":"2026-08-06T20:53:53.706900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-06T20:53:53.781669Z","title":", Stiennon , N","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.781669Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:0f355164ae0ee54aba23f3a03ccb0c7f114d62e3d53bc554ec57de5b2b565322","observation_id":"b4038d34-0650-4519-9b81-f71ca1e88fda","resolution":{"observed_at":"2026-08-06T20:53:53.781669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:53:53.890488Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T20:53:53.890488Z"},"links":{"citing_paper":"/paper/2507.01691"},"observation_digest":"sha256:0fec40c1c270cd0e6a15e317263a73ee50b0f1cb0c09e5a8db62286dacf56228","observation_id":"b7a1847b-9d24-45d1-9dab-745360ae442b","resolution":{"observed_at":"2026-08-06T20:53:53.890488Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.01691","last_updated":"2025-07-02T13:17:51Z","latest_version":1,"primary_category":"quant-ph","snapshot_observed_at":"2026-08-09T03:49:11.699208Z","submitted_at":"2025-07-02T13:17:51Z","title":"Quantum reinforcement learning in dynamic environments"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":35,"verified_exact":13,"verified_fuzzy":10},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 2 inbound Pith citation observations for arXiv:2507.01691."}