{"as_of":"2026-08-14T22:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1ce0c4931448275efda0bbb25390399729a74e3fb38334e3dbb7b56e7cfa44e9","coverage":[{"denominator":125,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T15:52:37.126481Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:30:53.514870Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T05:30:53.663137Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"cited_work":{"arxiv_id":"2412.10692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.10692","snapshot_observed_at":"2026-08-07T05:30:53.663137Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","venue":"q-fin.MF","work_id":"e3ad1075-4470-43c6-aba0-b13185109229","year":2024},"citing_paper":{"arxiv_id":"2506.08121","last_updated":"2026-07-13T21:00:23Z","snapshot_observed_at":"2026-08-12T05:58:47.315124Z","submitted_at":"2025-06-09T18:20:21Z","title":"Continuous Policy and Value Iteration for Stochastic Control Problems and Its Convergence","version":2},"reference_index":509,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:53.514870Z"},"links":{"cited_paper":"/paper/2412.10692","citing_paper":"/paper/2506.08121"},"observation_digest":"sha256:8c3fc34e3963ab0ff503f714b693fae13a5b71578b2feaf30511cf8613c11b19","observation_id":"b09019a2-a1b7-442f-88e0-72283ced5ea6","resolution":{"observed_at":"2026-08-07T05:30:53.667643Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.10692/citation-record","integrity":"/paper/2412.10692/integrity","json":"/paper/2412.10692/citation-record.json","paper":"/paper/2412.10692"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.735852Z","title":"Silver , author A","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.735852Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:a518383d42abd067b7eb87c150273d55373b3cc72037af22acd64ec9e32912fa","observation_id":"316c72db-a1af-442c-822c-7ee60466c32c","resolution":{"observed_at":"2026-08-11T15:52:36.735852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.740343Z","title":"Silver , author J","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.740343Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:e51053f79f8546e6e025c2fdb56653f629b7828a903fc00701e1b415bdbdfc5a","observation_id":"8c4eb0e4-20ff-4ccb-a61c-a309e37ea4e2","resolution":{"observed_at":"2026-08-11T15:52:36.740343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.745138Z","title":"Bertsekas , title Reinforcement learning and optimal control , publisher Athena Scientific , year 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.745138Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:ad175bd9d3d83f85ba8826ff1e824955093b6e7981ca7f64e94335e9ea9bc9dd","observation_id":"24444c51-bc2e-49f2-8f7c-66d3ac2ecb2a","resolution":{"observed_at":"2026-08-11T15:52:36.745138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.748694Z","title":"Williams , author N","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.748694Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:7d0a9fae1bfc003765775b166c1026167024c02145a21a0bd3ce953ff890e153","observation_id":"c15654cc-ab4c-43d8-8974-bfb03951e240","resolution":{"observed_at":"2026-08-11T15:52:36.748694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.752000Z","title":null,"venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.752000Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:32adcd75293f669a74f412ec57240f58c54d749d0d25afbd7208bd08ed0b2cd1","observation_id":"5ed7c4e0-a83a-4b7d-82e3-dd99d5fe8c37","resolution":{"observed_at":"2026-08-11T15:52:36.752000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.755307Z","title":"Schneckenreither , author S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.755307Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:8983ac2975fb33844b4dce225f84ef33cc5cfc7a339836655c042090de82f61a","observation_id":"11daa9bc-90df-4bc9-916a-4ed8cc6cde47","resolution":{"observed_at":"2026-08-11T15:52:36.755307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.758617Z","title":"Bertsimas , author A","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.758617Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:aba235d9e0e7e42d0a9a9787216fed3706f9b7588755b6bcc370b29829054b98","observation_id":"7f0e43c9-ebf3-4159-9343-4cc0ab42f31c","resolution":{"observed_at":"2026-08-11T15:52:36.758617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.761577Z","title":"Nevmyvaka , author Y","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.761577Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:8755c5422ec9ad3ba731591013117346b83c61ccb08e548317bf59f88dfa4ecd","observation_id":"8b36781b-0520-46b1-9439-bea21e655abb","resolution":{"observed_at":"2026-08-11T15:52:36.761577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.764377Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.764377Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:39bc979228aa58b6c68e2d6b14e62ea5cb9ff920420d734ff0331c4ed413fb8f","observation_id":"b67dd617-a01c-4346-8c27-f0f1eaad2c69","resolution":{"observed_at":"2026-08-11T15:52:36.764377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.767250Z","title":"Hendricks , author D","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.767250Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:7402e3caf35d91312dc2b9579f8b336ebce2ebdc85034157ec2b9b7050c17e2c","observation_id":"96a36259-d7c6-48ed-b8ab-928bba1866b1","resolution":{"observed_at":"2026-08-11T15:52:36.767250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.770722Z","title":"Moody , author L","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.770722Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:809080d5e5abc92ed5d1425fb2199fd15f8f1f4a3d6dd8b50a1f11fc06bedc58","observation_id":"40673231-c637-4d8b-8530-f7461245d5ac","resolution":{"observed_at":"2026-08-11T15:52:36.770722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.773922Z","title":"Wang , author X","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.773922Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:7a50f421fe64b7666f4aeeac781ec4698e19d11a2412a9229fee12efe85c48b5","observation_id":"207f6ab3-2a28-4a09-855d-93fb2448c3a9","resolution":{"observed_at":"2026-08-11T15:52:36.773922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.780652Z","title":"Dai , author Y","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.780652Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:9dfe7f315ea1f4a982a13e314d7a998fbb8ef0311a1eb99cfbfb872a62c11a97","observation_id":"b46a5cac-81b3-46f6-bb28-ddfaf0e9ba3b","resolution":{"observed_at":"2026-08-11T15:52:36.780652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.784155Z","title":"Jia , author X","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.784155Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:42ebd06cb3b5b63ebcb52d8a460ccc4efa5963254e93f5d90e0752794974dd75","observation_id":"03e0ed1f-58c8-4e5b-b307-051ba8f1dc9d","resolution":{"observed_at":"2026-08-11T15:52:36.784155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.787600Z","title":"Gosavi , title Reinforcement learning: A tutorial survey and recent advances , journal INFORMS Journal on Computing volume 21 ( year 2009 ) pages 178--192","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.787600Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:4ad8afc01a4e3400bbb158e8788b2f61c60065d59f04808ee198215542ee7c05","observation_id":"925e79d7-a16b-401e-b54d-523d23ec99d4","resolution":{"observed_at":"2026-08-11T15:52:36.787600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.795148Z","title":"Jaimungal , title Reinforcement learning and stochastic optimisation , journal Finance and Stochastics volume 26 ( year 2022 ) pages 103--129","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.795148Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:5637db4e77837b2d052cceac40550e4b94931aaa6d59b93b3afc89b9ca7ab1f3","observation_id":"5d64ecb5-fb77-430f-8bce-aa230f6da836","resolution":{"observed_at":"2026-08-11T15:52:36.795148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.798694Z","title":"Charpentier , author R","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.798694Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:9771fd70783ecfcb193b5305b843ebf9082f00bcb6dcaa53c8c0c8fc524eeb00","observation_id":"85526542-7ce6-4b4c-97aa-e7b2a6b8b2d6","resolution":{"observed_at":"2026-08-11T15:52:36.798694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.802186Z","title":"Doya , title Reinforcement learning in continuous time and space , journal Neural computation volume 12 ( year 2000 ) pages 219--245","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.802186Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:2753ac3fda9bd0a6b8ae73fb9fffba5463c349dec1b80d5b0c7bdc366a51a8bb","observation_id":"8f6322d4-644b-48c9-980a-e8ef68e7b146","resolution":{"observed_at":"2026-08-11T15:52:36.802186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.805919Z","title":"Fr \\'e maux , author H","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.805919Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:d38a329395d06c58a34f0ccd35fef1c2ab7c42dbd794be82915653342ed1dd70","observation_id":"d6d53cce-45a0-4c6a-9756-d958f4c582a6","resolution":{"observed_at":"2026-08-11T15:52:36.805919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.809614Z","title":"Lee , author R","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.809614Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:78d8dc612aee3291d550ab7cd33e2a0150dee8216c7b046aeb0c207e9b22985e","observation_id":"8f241fd8-45da-4115-828b-97419f65ae5d","resolution":{"observed_at":"2026-08-11T15:52:36.809614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.813423Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.813423Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:899d1e6ccb690f8c544857fcb6570c54150897734c0c96ef1c47d49b408ca2fb","observation_id":"5d7dab6c-42e3-4bc7-9868-d23fb1cce255","resolution":{"observed_at":"2026-08-11T15:52:36.813423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.817035Z","title":"Liu , author Y","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.817035Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:55561a6278d3f97650393f75c1f620afc9796f753cda165582ddc4565852f4c0","observation_id":"8d0b0b7f-39ce-4721-9e5e-4930d2bd14a2","resolution":{"observed_at":"2026-08-11T15:52:36.817035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.821039Z","title":"Lee , author T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.821039Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:620e9d306ddebc410bccbd938f21e6ab9ba85b2b1d4802499e619cd775e4f21a","observation_id":"0599b045-342e-4760-a6c3-27a8f09a0073","resolution":{"observed_at":"2026-08-11T15:52:36.821039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.825131Z","title":"Wang , author T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.825131Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:2ffac232e3406eae29b70657be770adca91b9d67aeb26dad89024b26b0d2cb2e","observation_id":"d2eeda3f-54f4-4b3f-8f76-e1421fa57ae1","resolution":{"observed_at":"2026-08-11T15:52:36.825131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.829128Z","title":"Jia , author X","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.829128Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:43f14579531cb8340c2988292112f9ff15f6086538536caee0565b18ff693fa7","observation_id":"0c64e7a3-6c05-4b5f-b129-93fd121077da","resolution":{"observed_at":"2026-08-11T15:52:36.829128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.832954Z","title":"Barnard , title Temporal-difference methods and markov models , journal IEEE Transactions on Systems, Man, and Cybernetics volume 23 ( year 1993 ) pages 357--365","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.832954Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:85b317dd96f8123d59eee7bd3d9c826857375852cf6d42aeebfb5c6888a253f1","observation_id":"b303315e-1b25-489e-bff7-dace3bba914a","resolution":{"observed_at":"2026-08-11T15:52:36.832954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.837053Z","title":"Baird , title Residual algorithms: Reinforcement learning with function approximation , in: booktitle Machine Learning Proceedings 1995 , publisher Elsevier , year 1995 , pp","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.837053Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:f044c2d583181bc8c7ca4351f5a0a005c4f4bd2f770855ca0450483c5b4c23a7","observation_id":"34d3a2e1-97e1-4d0e-b7b0-330609669f78","resolution":{"observed_at":"2026-08-11T15:52:36.837053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.841065Z","title":"Guo , author A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.841065Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:3b158c5d1e0152d77618246d504c885fcca2e9a98eb4599818a5eacba0f6c678","observation_id":"f8a72ad4-3442-4360-b79e-663b14b59d5c","resolution":{"observed_at":"2026-08-11T15:52:36.841065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.849219Z","title":"Tang , author Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.849219Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:31e5654f2a23ca5a1330609fbad3e04ec2f13f041073d72e3e9f933cdee1141d","observation_id":"f9bf13fb-4ab2-417d-998a-6bfaf0d5f796","resolution":{"observed_at":"2026-08-11T15:52:36.849219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.856417Z","title":"Cuoco , title Optimal consumption and equilibrium prices with portfolio constraints and stochastic income , journal Journal of Economic Theory volume 72 ( year 1997 ) pages 33--73","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.856417Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:3d689d8630979eb33dcfc24aa0a5d9a08916f7e3d8dd509f0996b9b2e6e6f70a","observation_id":"41e18309-7667-4d78-a37c-cb6c48447ca1","resolution":{"observed_at":"2026-08-11T15:52:36.856417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.860291Z","title":"Dai , author Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.860291Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:b00bfc1a6d4ee48705b35132c67b4f5b22212cff4007f6e920532a33b1cbc22b","observation_id":"6ebe851f-99c2-4037-90ca-33cb674779b4","resolution":{"observed_at":"2026-08-11T15:52:36.860291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.863649Z","title":"Dai , author H","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.863649Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:10e13389c841b926bcc664a7fd3c80cfdcfe2dd07a1cb98be499a537e32cc2d5","observation_id":"7795fb9c-4463-410a-ad02-b79633cc4d29","resolution":{"observed_at":"2026-08-11T15:52:36.863649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.867031Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.867031Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:d2d11453aad871db1aa2f353af275857254c102c5302a7fe4a479f8224d496e2","observation_id":"39819b19-96f6-4b66-9683-7b2b9ba92fe0","resolution":{"observed_at":"2026-08-11T15:52:36.867031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.870680Z","title":"Pham , title Continuous-time stochastic control and optimization with financial applications , volume volume 61 , publisher Springer Science & Business Media , year 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.870680Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:6dcbcf27f26683c43e57fc4313a68d0e29037bad8951ec1cc7e368dcfa63e03a","observation_id":"02d96a81-f46e-4053-a97b-a30265baff5b","resolution":{"observed_at":"2026-08-11T15:52:36.870680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.874035Z","title":"Chen , author M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.874035Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:777bff564e019814626f5dd75b9f852054e95f2821305ced8fa7bf6c88e75e2f","observation_id":"3231059e-725b-4634-b946-7fe598766933","resolution":{"observed_at":"2026-08-11T15:52:36.874035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.877284Z","title":"Kamma , author A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.877284Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:e36ca935b2643893a9f340611527a2c874336d719c955e134c8dabb7d64ef5f8","observation_id":"5473d0f3-1327-44a4-aa98-ef58ec8a8d25","resolution":{"observed_at":"2026-08-11T15:52:36.877284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.881131Z","title":"Karatzas , author S","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.881131Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:1d81a3f64d9f10055884e9a7bd18bad635935ce72bb20c0fe80b644ebb407c4a","observation_id":"aa1f9ab7-68a7-48cc-8b8a-ce0edf8b8278","resolution":{"observed_at":"2026-08-11T15:52:36.881131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.885163Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.885163Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:3ee8af35beee38e2c51bd41419fc635915f8ce5124dd09395c4799c2064a1da6","observation_id":"80e031f2-08ed-4a38-b200-a61ed1e39f09","resolution":{"observed_at":"2026-08-11T15:52:36.885163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.889168Z","title":null,"venue":null,"work_id":null,"year":1976},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.889168Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:b1d734bb61af0666e694c4e42bae641c80b7abd39664a41584112ebe72c03dd6","observation_id":"1ac55cd7-d77e-41ac-82cf-6b9715d2c9ca","resolution":{"observed_at":"2026-08-11T15:52:36.889168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.893301Z","title":null,"venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.893301Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:6ced035a7322c1f4ce93ab20ff4877b9695429a00cf61a4c41ce94eaeae3eb1b","observation_id":"ab7b1af1-ab6d-40be-85ce-942972ee05f4","resolution":{"observed_at":"2026-08-11T15:52:36.893301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.897034Z","title":"Nicole el , author N","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.897034Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:fcc7aa7a05a43a01b77b8717bbaac9706b4b7625a04660f97f8a547703bdc464","observation_id":"5c17c287-3b35-455c-b653-b34957bf2d7e","resolution":{"observed_at":"2026-08-11T15:52:36.897034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.901892Z","title":"Donsker , author S","venue":null,"work_id":null,"year":1974},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.901892Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:7b882a06cb2215985ab7339516dfc370799cb2149871f74705172681b0cb3e80","observation_id":"99cfc382-0c1f-4c1e-85f8-dc55bf51df64","resolution":{"observed_at":"2026-08-11T15:52:36.901892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.906011Z","title":null,"venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.906011Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:516502d995577dd9507537e2d4eab5e631637655148af73be413a0d5907c64ad","observation_id":"7cae7002-faa5-4a47-b866-6bccf9fb807c","resolution":{"observed_at":"2026-08-11T15:52:36.906011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.910072Z","title":null,"venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.910072Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:3f235752d6ad4e5c3d37510853ce4cf415a1aa3180c70975e22d236ed61b98a3","observation_id":"7751b527-86fe-4edb-8273-838f4b4b57a0","resolution":{"observed_at":"2026-08-11T15:52:36.910072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.913814Z","title":"Gerrard , author I","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.913814Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:444c24df761f0f86c114c4eac7678667603722a924ad59bb9b2c0718274c74d5","observation_id":"9631407c-f9e6-40cb-a79c-e76867405bde","resolution":{"observed_at":"2026-08-11T15:52:36.913814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.389336Z","title":null,"venue":null,"work_id":"0885e633-034a-413f-bc66-fef8184c83c2","year":1975},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.917686Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:0138db391e2b8baea7a42bee681ab1320e107e223eefc3ff36ba4e94c4218508","observation_id":"cd03627c-710f-4eed-bd41-148953d53601","resolution":{"observed_at":"2026-08-11T15:52:38.393093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.379674Z","title":"El Karoui , author M","venue":null,"work_id":"1bb62175-4bc8-402e-bde2-fc69abaf82ff","year":1998},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.921691Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:2ae234739c1b46bbed5ff8a19f82e5c016a92dc18db50890503ba871536902b2","observation_id":"37f0bed6-534e-415a-bd05-761483c331a5","resolution":{"observed_at":"2026-08-11T15:52:38.383085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.369286Z","title":"Friedman , title Partial differential equations of parabolic type , publisher Courier Dover Publications , year 2008","venue":null,"work_id":"b41e3227-1066-4a60-8274-b544926b65ae","year":2008},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.925538Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:cde83720dcfbd1373e72967e4120d139f560f42901207acaa613e9f22ca4c8c9","observation_id":"89eef434-7437-42a2-9bf2-39133d4209c9","resolution":{"observed_at":"2026-08-11T15:52:38.373011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.357809Z","title":"Kotz , author N","venue":null,"work_id":"be50ad2f-fe3a-4b10-82c5-772ba7d84c27","year":2004},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.929446Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:6df698639452530bee12ce3ed4819231c6d83929ea5a819ccd705134311b94fb","observation_id":"64a2d961-8393-4243-a715-247b55cff565","resolution":{"observed_at":"2026-08-11T15:52:38.361789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.344693Z","title":"Csisz \\'a r , title I-divergence geometry of probability distributions and minimization problems , journal The annals of probability ( year 1975 ) pages 146--158","venue":null,"work_id":"57b1e848-05d7-454c-906d-6c309c7503cf","year":1975},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.933318Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:a001ca4f10ee96752e050c48d1d423d59327465d60983ac9c40bd50927aa9301","observation_id":"895e0d24-1909-4792-8ca3-6f9cb10695ee","resolution":{"observed_at":"2026-08-11T15:52:38.349113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.331646Z","title":"Duffie , author H","venue":null,"work_id":"697661e7-5910-4696-9894-dc7ffc11ca5b","year":1991},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.937390Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:9e35e89a424e0c1b0c12dc910191e241cf0db5a9dc68032ffde4b27892e876fd","observation_id":"975c46c4-37e2-4308-a3d4-d6a1fe761ff6","resolution":{"observed_at":"2026-08-11T15:52:38.336701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.319237Z","title":"Bodnar , author N","venue":null,"work_id":"7d01fc9b-ad8d-4002-9894-769d7bfc7375","year":2013},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.941268Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:13fde6d1a9a659e3ecdcd85ccca80cee76b31afc52d3d2cb85227f350a4fb27b","observation_id":"6710a9eb-1a20-4605-a964-3f127f7a7f93","resolution":{"observed_at":"2026-08-11T15:52:38.323092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.307162Z","title":"Li , author X","venue":null,"work_id":"d2caead4-8da4-4618-866d-06b849edb4a9","year":2002},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.945185Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:b3ba02f8f0214ca41e0a4a69d011baa446899f938c3d4a8ed920f55fd46f9e2b","observation_id":"95ec0fdb-21a3-435c-afab-d9116a5f8edd","resolution":{"observed_at":"2026-08-11T15:52:38.311226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.293363Z","title":null,"venue":null,"work_id":"55f1e2f5-5d1f-465e-86e0-d12bdcb59909","year":2005},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.948935Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:eded298ded69dc3d1240459d32402727fb97e6497694e49be802678c17928b5c","observation_id":"841d97c5-7618-4574-a971-647c6d4db6a0","resolution":{"observed_at":"2026-08-11T15:52:38.298055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.280603Z","title":"Li , author Z","venue":null,"work_id":"e4d22889-04c2-435b-a08d-eb36fec03454","year":2016},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.952536Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:d25eb5dd5b1394dbb843e9c11ebd03fc4605fe0de4747067181bedfd62bb26b1","observation_id":"3d5f8caa-608c-4d5b-b778-7956907f98d2","resolution":{"observed_at":"2026-08-11T15:52:38.284544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.267976Z","title":"Jia , author X","venue":null,"work_id":"9dba2096-d974-4008-a604-aaecc61c7247","year":2023},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.959656Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:065fd31684330c40cb87a7c0529f7bc7099009382381a3af5a0e877078d7df54","observation_id":"e56119bf-35ce-4835-801f-c6a8e79ebda2","resolution":{"observed_at":"2026-08-11T15:52:38.272310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.255814Z","title":null,"venue":null,"work_id":"0594219f-d6ab-49da-b33e-8793597eb041","year":1995},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.962964Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:0ef6141c6059f6fad26790feba5ec2703c5cf42d0fbe35db289ef766fce008f9","observation_id":"5c9cdef9-8b0a-4feb-a743-a5eb9141e628","resolution":{"observed_at":"2026-08-11T15:52:38.259649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.244337Z","title":null,"venue":null,"work_id":"c8c24ba0-dff9-435b-a3f2-f4654963cf1c","year":1993},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.966423Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:2c6e6381fb3e5add31cef494651d8f2a82d0b1659498be9ed8aebe0959a32cfe","observation_id":"ca7b08dd-4a3d-4be9-9d06-4fe330bacde3","resolution":{"observed_at":"2026-08-11T15:52:38.248597Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.232299Z","title":null,"venue":null,"work_id":"702b1f99-4eb1-4414-ae10-d83f6da4b79b","year":2019},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.969811Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:5e4cb6926cc0a7ba81fc30712ab43a1be75418a9246f1e23a79e2b346f120155","observation_id":"686743c1-6509-466a-8c16-c058e23dbb6b","resolution":{"observed_at":"2026-08-11T15:52:38.235987Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.973208Z","title":"and Thiele, A","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.973208Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:6026e9ca01bec463bad38688c5f2466a760517b6e620d94b3e7f3360173761ed","observation_id":"8fa11201-41f5-43b8-b408-83c428363dff","resolution":{"observed_at":"2026-08-11T15:52:36.973208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.214027Z","title":"R., Jin, H., Pliska, S","venue":null,"work_id":"fd0695af-87d0-45b6-a583-98aa3d504c31","year":2005},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.976768Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:65d4e2c05d85c766fee61b0b0f9ff0aed394a090f9c10abce8f313ba55cb9cd8","observation_id":"b591e7f7-3cee-4cba-8c0a-c0c9e8f42818","resolution":{"observed_at":"2026-08-11T15:52:38.217642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.202092Z","title":null,"venue":null,"work_id":"9a258c6b-1286-4bac-a6f5-2781601c9f81","year":2013},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.981913Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:80eb3b7f9572c76292d43c3591e4fb80c21e30d001e9ecf652623b1a94aad98c","observation_id":"bb0e44cb-01a8-4671-a27c-de6adebf334d","resolution":{"observed_at":"2026-08-11T15:52:38.206282Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:36.985912Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.985912Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:b6de37c884f96e3bcc1320aa14ae0af950543586b5e31e3ff0e58fd6d2af7d2e","observation_id":"b642106e-b2d4-4bce-95c1-3550e2314ed0","resolution":{"observed_at":"2026-08-11T15:52:36.985912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.182721Z","title":"and Vellekoop, M","venue":null,"work_id":"f7f84eda-4d9b-4d5c-866b-3b83e7067d6e","year":2017},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.990105Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:1dbca39a7a613a60e8aa31666e34ee91bd581a28fe0c1933889ce63d36f2de39","observation_id":"83f128d3-1cd1-4a5e-93d4-5f051576f57c","resolution":{"observed_at":"2026-08-11T15:52:38.186098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.169795Z","title":null,"venue":null,"work_id":"883078b1-9022-49d5-97a2-b21a997a407e","year":1975},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.993970Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:f211381c8095b0e48aee73409527639c265d77b1d5dcb8970173225e060d4634","observation_id":"2205bd8e-96bd-41ed-8422-aa19a3862dc0","resolution":{"observed_at":"2026-08-11T15:52:38.173615Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.157616Z","title":null,"venue":null,"work_id":"b7f1dae5-b9a4-498a-9997-7a02f689682f","year":1997},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:36.998299Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:65549daa6020727f43e28e5ef393d8d1635ebf4d2acd376981ce461d6c307df6","observation_id":"60fbbba6-c0de-46ac-b5c0-bbde12f32ba4","resolution":{"observed_at":"2026-08-11T15:52:38.162378Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.146094Z","title":null,"venue":null,"work_id":"537739f7-d4ef-4b62-8759-e2d9600981dd","year":2020},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.002389Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:25e0b20035717b36a71a289fdd2a95570cb1d5868155c69ccb26c01577c6b3a6","observation_id":"b6e53bf2-22eb-4b7e-a00b-b42f488d2c04","resolution":{"observed_at":"2026-08-11T15:52:38.149885Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.133326Z","title":null,"venue":null,"work_id":"c0309f80-5250-4dcf-92cb-4f4ba2bc617d","year":2023},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.006741Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:ac47da5a099333a2d562a879f356d2abfe3b859f76bae6358e09f8da8176c063","observation_id":"17e2c93e-6c3e-4141-82b1-00549f5caa9f","resolution":{"observed_at":"2026-08-11T15:52:38.137182Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.121647Z","title":null,"venue":null,"work_id":"b1cff3b2-18f4-4568-9046-37c12207bbe5","year":2021},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.010762Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:633553f37914dd9c18101216c11af1437357b9cd76a6d0451c177425df543085","observation_id":"78aa5ecc-b01a-4b1a-89ee-7288be556797","resolution":{"observed_at":"2026-08-11T15:52:38.125671Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.108066Z","title":"and Varadhan, S","venue":null,"work_id":"c16f680a-ed04-4185-b93f-810dfa9d2738","year":2006},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.015073Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:715831154e3b8bbde7c22fe9488ac0bfcf8b868a0427ae1d1feba0ffec31b311","observation_id":"c4eb6ac6-ac9a-4c48-9dab-2244c46e6517","resolution":{"observed_at":"2026-08-11T15:52:38.112011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.097553Z","title":null,"venue":null,"work_id":"34396433-3f12-4eb6-9b45-64f701b96bd3","year":2000},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.019180Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:f9cef905b108fa56a4bd9350ee1b27439e5802ea9a23a46588c370d86dacd957","observation_id":"efc5ea3d-f215-4728-9749-801ce92aded5","resolution":{"observed_at":"2026-08-11T15:52:38.101057Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.086577Z","title":"and Richardson, H","venue":null,"work_id":"802a2a79-d1e1-48e4-84cc-780152748fa3","year":1991},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.023043Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:570af4cef45ebc6419e7029d2dcff8ac1cc03cfc09789a5cc84516a069b14b05","observation_id":"f34cfd42-65f1-4c8c-b34c-8857a3421a07","resolution":{"observed_at":"2026-08-11T15:52:38.090450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.075010Z","title":"and Jeanblanc-Picqu \\'e , M","venue":null,"work_id":"e2c81002-3f9e-4623-902d-07b6dfd15993","year":1998},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.027514Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:9b768369fad362e97fff6b67f7903e9359957419ce116d77fd336b59d7d5e9a4","observation_id":"a7a98985-01d2-4926-bea5-d39849409ae6","resolution":{"observed_at":"2026-08-11T15:52:38.078897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.063794Z","title":null,"venue":null,"work_id":"f83488be-26d4-4eae-b76d-a1fae69e3fca","year":1976},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.031465Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:a6c480945a394ef73e0c59969213360ec910e4308c4e5bacc01a4e3139f5cd9a","observation_id":"29fff33e-73d2-4d15-885d-d5f1d30d4ecd","resolution":{"observed_at":"2026-08-11T15:52:38.067687Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.053754Z","title":null,"venue":null,"work_id":"263f20ee-dec8-40ee-9d87-4f3592163513","year":1984},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.035393Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:530a61967ab98fd51b8a316dc84d9e40c6c74eea629a9dc498a075b23b38a25d","observation_id":"21a910d6-7287-457f-98a5-472fb30895be","resolution":{"observed_at":"2026-08-11T15:52:38.056948Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.043766Z","title":null,"venue":null,"work_id":"f9f6336e-c53d-428e-a713-226300cc9afe","year":2006},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.039470Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:6e2c943228646ce9daebbdf948a13571e396dd756ffc41fbcb8bc76c1fad8762","observation_id":"00401485-5a25-42b4-bb6c-adbb03e68909","resolution":{"observed_at":"2026-08-11T15:52:38.047157Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.032946Z","title":null,"venue":null,"work_id":"530276dd-6c20-486a-b131-3d2418eb965a","year":2013},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.043558Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:d47099fea95b389d3fdd10fcab5a778c5d98e55e2aef34fdaa788617e00eb877","observation_id":"72fd5e8a-6f51-4ead-a23d-b6da14194a15","resolution":{"observed_at":"2026-08-11T15:52:38.036598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.020545Z","title":null,"venue":null,"work_id":"76a514ae-55cc-4d9c-bfa6-7ed48549eb0b","year":2008},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.047526Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:8d0a8c01537582addc45468ec87f4f8f700ebffc764949bebdeb01aa8c6381e6","observation_id":"ef0be447-ed34-481d-b7a8-12c92ab97f16","resolution":{"observed_at":"2026-08-11T15:52:38.024905Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:38.008982Z","title":"P., and Vodi c ka, P","venue":null,"work_id":"547b2bfb-f440-45b7-98ec-89e37bf8d1d7","year":2023},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.051633Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:7d8c514574691fb7466d1e2a8437122d7499d02212a638b5506de140d717ceb6","observation_id":"5f7c1ad2-e338-4c20-ae4c-4df2f8a59dcd","resolution":{"observed_at":"2026-08-11T15:52:38.012656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.997253Z","title":null,"venue":null,"work_id":"6cc8ea40-54db-4632-8392-31ea65f1b3ad","year":2009},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.055573Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:9e3bbb135c940a8cae0247328f0fb98bc64ece1ae645457685a1e4995ccfe6a1","observation_id":"9b734fd8-9969-4432-86eb-6fa3728f5fa7","resolution":{"observed_at":"2026-08-11T15:52:38.001454Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.984649Z","title":null,"venue":null,"work_id":"24ba0c17-92a6-4df2-8ad2-5734a640c302","year":2022},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.059440Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:e378ba714bef8c054f06b45bd1970920dc38f2a5a19f108519846be3b38ec970","observation_id":"30f35dca-2e09-4391-ab85-917df9c0b060","resolution":{"observed_at":"2026-08-11T15:52:37.988544Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.04553","last_updated":"2023-02-28T07:55:21Z","snapshot_observed_at":"2026-08-13T17:19:13.734237Z","submitted_at":"2021-12-08T19:55:26Z","title":"Recent Advances in Reinforcement Learning in Finance","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.04553","snapshot_observed_at":"2026-08-11T15:52:37.063495Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.063495Z"},"links":{"cited_paper":"/paper/2112.04553","citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:de0877a3de6fe4dd41bc66139356b96e308305d107ff8c04f592e9c2b3b03d51","observation_id":"032fd8b2-1230-4e8e-8a42-c4d076985ddc","resolution":{"observed_at":"2026-08-11T15:52:37.063495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.973065Z","title":"and Wilcox, D","venue":null,"work_id":"ef10b715-e7d0-4de3-a6c5-c03642b4d82e","year":2014},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.067109Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:5d8b8dc5db462e5bcb267365a24502ff8be04c15ce02dc4abe3d689cff472b2a","observation_id":"e83fa80d-d405-4caa-84f2-68ebcf45304e","resolution":{"observed_at":"2026-08-11T15:52:37.976846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07059","snapshot_observed_at":"2026-08-11T15:52:37.070457Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.070457Z"},"links":{"cited_paper":"/paper/2209.07059","citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:22311add26d7c0cefb4f7a1c538ee0b83f4199a25399e6642c3405b4a8169f01","observation_id":"515f29ec-a540-42de-864a-95f813e05948","resolution":{"observed_at":"2026-08-11T15:52:37.070457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.961845Z","title":null,"venue":null,"work_id":"dfe79443-d075-4fa1-bd10-ca1c53b5f19e","year":2022},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.073394Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:792a474713b768c537e7c3c5f83bac3d8f2351f1ec6ef7acd0edb26124200117","observation_id":"be90a9fd-1fcd-497e-beee-2986c9757faa","resolution":{"observed_at":"2026-08-11T15:52:37.965707Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.950603Z","title":"and Zhou, X","venue":null,"work_id":"e448a00a-0966-44a8-bf4f-c6245fffc13f","year":2022},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.077235Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:38e226e33bb98da96299888bdc14b39bb12a7d1e5f553b48887292b27e04518d","observation_id":"1c32bb3c-53e5-4282-a763-0dd069d8ec61","resolution":{"observed_at":"2026-08-11T15:52:37.954420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.939136Z","title":"and Zhou, X","venue":null,"work_id":"fdc026fc-61df-4218-a277-7b2ae6524d36","year":2022},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.080409Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:328d45dc367cde543f0ff6a0477efd4f7ad3996e41602a5dd6df4c2e66fdb5a0","observation_id":"67243b1c-ec38-4611-9a22-f5e37a22c33a","resolution":{"observed_at":"2026-08-11T15:52:37.943165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.927590Z","title":"and Zhou, X","venue":null,"work_id":"a66bb335-373b-4a76-8539-8ab5b990d5fe","year":2023},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.083497Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:e7ceab71e01f7f12a228e5ca584c482057078dea8b286669dad3236effed794b","observation_id":"140487da-42d7-4b08-9b33-8ca26f3d30ea","resolution":{"observed_at":"2026-08-11T15:52:37.931333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.086519Z","title":"P., Littman, M","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.086519Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:adc8d0989f32efe556d3527453a92ad86b159645418be61780022930b3ade67f","observation_id":"49eed0e5-c44a-4a75-b3ff-98b80373e57e","resolution":{"observed_at":"2026-08-11T15:52:37.086519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.911126Z","title":"and Pelsser, A","venue":null,"work_id":"a2856261-72cc-43d1-939a-a9691fe8cb6d","year":2022},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.089504Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:2e5c6c0c7081db54558845be1820bfc74092f5749818b52be6aaaf8ff6d0e47d","observation_id":"c6155c07-2f9c-494c-8e36-056669bcf512","resolution":{"observed_at":"2026-08-11T15:52:37.914425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.900672Z","title":"and Shreve, S","venue":null,"work_id":"ba1786d7-a766-4982-8ea4-e5d84e72e72c","year":1998},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.092727Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:78a43a4d313b28f45a4424e33fd317543784ae948d772e0d6883a679dc64f639","observation_id":"a12ac44b-ff88-41d7-a516-fee07e9fde37","resolution":{"observed_at":"2026-08-11T15:52:37.903816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.01404","last_updated":"2024-11-12T21:09:50Z","snapshot_observed_at":"2026-07-06T10:01:12.123445Z","submitted_at":"2020-10-03T18:17:34Z","title":"Mean-Variance Efficient Reinforcement Learning with Applications to Dynamic Financial Investment","version":4},"cited_work":{"arxiv_id":"2010.01404","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.01404","snapshot_observed_at":"2026-08-11T15:52:37.381576Z","title":"Mean-Variance Efficient Reinforcement Learning with Applications to Dynamic Financial Investment","venue":"cs.LG","work_id":"4ece0d3e-9195-4129-8a3b-be774b65f450","year":2020},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.096415Z"},"links":{"cited_paper":"/paper/2010.01404","citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:21d4441b181377f80d2dd394c411a48c612c3d232a1a335e7bd413bee2798a2b","observation_id":"e9ffd505-06cb-4d55-b057-bd4c98b7f57e","resolution":{"observed_at":"2026-08-11T15:52:37.386957Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.890648Z","title":null,"venue":null,"work_id":"e833feaa-3038-4baf-b8f9-ff38ef59ef09","year":2004},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.099845Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:925b33bb68695797e1170112e7ab801520ed59412780c69fe8f7def236439368","observation_id":"527108a0-0945-4847-9fca-9fe8b441071c","resolution":{"observed_at":"2026-08-11T15:52:37.894033Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.879398Z","title":"and Lee, T","venue":null,"work_id":"e23fc02c-e38e-4fa8-b6db-84c45f2cbede","year":2021},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.103933Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:06deb42f8fc25428057e41451ad12ea18322571072a09cb171c4b9d07d88296b","observation_id":"cc30b47b-459e-4dd9-9a28-7b1485fc0237","resolution":{"observed_at":"2026-08-11T15:52:37.883088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.868391Z","title":"and Sutton, R","venue":null,"work_id":"059872ec-0b46-4124-b44d-752b51b706a7","year":2021},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.107738Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:3e96daa51779fc107b5521e533447d567dc3e4e6b53d1313374b98797e88a689","observation_id":"4f280c35-d8e8-433d-9024-2044372d95b9","resolution":{"observed_at":"2026-08-11T15:52:37.872028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.857113Z","title":"and Xu, Z","venue":null,"work_id":"448dd3d9-4417-4f14-ac63-12dc0b8ea203","year":2016},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.111419Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:d22b304c44ad1e7023c310a4e7a3f1205c2a6e1940e5157ef6f6cc0a580cd436","observation_id":"3f148b81-a2f2-4517-8f90-2a2963649a57","resolution":{"observed_at":"2026-08-11T15:52:37.861044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.845491Z","title":"Y., and Lim, A","venue":null,"work_id":"5113463e-66a5-4708-a0d4-ff479a3e0222","year":2002},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.115102Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:d5b3e7494ed6a47bd97e6d1b19bbd4c8ee8e743a6e84f08d687e3288d8a8a0cf","observation_id":"d3f4ab93-d895-4fb9-919b-3b2fba19d20a","resolution":{"observed_at":"2026-08-11T15:52:37.849507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.832966Z","title":null,"venue":null,"work_id":"037a3bf2-264c-4882-9575-37d764dd1119","year":2020},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.119044Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:9c748ca768bb31e98bb7ec6e7c3827edc5b1544bb918f704d9229b7bc37746fc","observation_id":"1e73244b-5982-42b7-9b7a-ef071d541f98","resolution":{"observed_at":"2026-08-11T15:52:37.837159Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.820433Z","title":null,"venue":null,"work_id":"9416f9e0-22fd-4477-a722-858fa0622cb8","year":1998},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.122746Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:d9e307f7591c911d7482b55452050bc02f425a3dedf67a6a99b2ee3b4ba50d1a","observation_id":"a0fff255-1595-442f-ba28-f96ba036b83f","resolution":{"observed_at":"2026-08-11T15:52:37.824315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:52:37.805049Z","title":null,"venue":null,"work_id":"6e85d4ac-bda7-42b6-9b88-4b94d349a5e8","year":1975},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.126481Z"},"links":{"citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:6539fd83fc23a194f62aafec9793d01de447dfac16a364adceccc6e1ca8c4bcc","observation_id":"c3efb4ac-e0e4-45dc-b71a-c15483053dd0","resolution":{"observed_at":"2026-08-11T15:52:37.811196Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","latest_version":1,"primary_category":"q-fin.MF","snapshot_observed_at":"2026-08-14T02:29:23.338306Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":74,"verified_exact":1,"verified_fuzzy":25},"total_outbound_references":125},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 100 of 125 outbound references and 1 inbound Pith citation observation for arXiv:2412.10692."}