{"as_of":"2026-08-18T00:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:02169063dc3411bc4f1654e4b1379b0b5f1b9942d76b3fc35009f0622d966a2f","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:01:08.600180Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.14125/citation-record","integrity":"/paper/2506.14125/integrity","json":"/paper/2506.14125/citation-record.json","paper":"/paper/2506.14125"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.252800Z","title":"Constrained policy optimization","venue":null,"work_id":"98b79d8d-2bba-44e8-b101-582a5e89d80f","year":2017},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.396381Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:a1e7b4f076e1d68f3cf0a8d1aef98f73fa7e28856c02304b2cac78316aff83b0","observation_id":"5be75a55-5d9c-4f6e-a65e-ce76b800917e","resolution":{"observed_at":"2026-08-15T20:01:09.256897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.238904Z","title":"Safe reinforcement learning via shielding, 2017","venue":null,"work_id":"252da1b5-273d-4300-b8eb-e2d3232b4d59","year":2017},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.401174Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:2ac14449bbe9ac413db0971bd4c7c63844b19ff351547c7798c6c0d537721cb2","observation_id":"05f4c639-5402-4d0c-9e39-eb0f1b9d5967","resolution":{"observed_at":"2026-08-15T20:01:09.243510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.224524Z","title":"Asymptotic properties of constrained markov decision processes","venue":null,"work_id":"f13d8417-515b-4403-86cd-8bca6d69670c","year":1993},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.405566Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:b4ebaa3a27f073dbc2d060236344c59f014584f4aeb51b7ce68f5c7e8ddf3108","observation_id":"1d364716-2cde-46eb-9fbd-d48e60177199","resolution":{"observed_at":"2026-08-15T20:01:09.229000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.211275Z","title":"Deep reinforcement learning for demand response in distribution networks","venue":null,"work_id":"28739599-3204-43b4-a9d5-9530b14b28bb","year":2020},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.410077Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:e6413786ad34551856b9cfbd6b30239e1fdb2d163c763d2083cdb7d0cf4163c5","observation_id":"4c69894e-990d-4215-be53-24a5235ab0b3","resolution":{"observed_at":"2026-08-15T20:01:09.215622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.197479Z","title":"Dynamic allocations for multi-product distribution","venue":null,"work_id":"1199ac03-bb50-413e-b015-2f8037e0f899","year":1995},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.414520Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:66d079323731be5d142f57d046aaf9c4b1236b7945bea6a5695219e0b7779500","observation_id":"7e3fd9b3-e9a8-407e-a3c0-638221a2a80f","resolution":{"observed_at":"2026-08-15T20:01:09.202202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.184242Z","title":"Deliveries in an inventory/routing problem using stochastic dynamic programming","venue":null,"work_id":"d68d86f5-b4b0-4eec-b3c4-a4915bd6e3f3","year":2001},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.418841Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:da50daeee338ad228315630073b3e11d497f006f29b98b28f6b949cbde748f9f","observation_id":"ba30aaeb-4974-4d4b-90e1-479690a6b11b","resolution":{"observed_at":"2026-08-15T20:01:09.188578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.171209Z","title":"Resource constrained deep reinforcement learning","venue":null,"work_id":"7f3fb405-c4d9-40f0-9ff3-98a646769b11","year":2019},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.423605Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:2cf9fee0f029ae5f66be123a83b55c6f5e1b3df0755ad6e481c54cf266990806","observation_id":"0e48722e-60d5-4a7f-be11-af9e8544ea56","resolution":{"observed_at":"2026-08-15T20:01:09.175242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09583","last_updated":"2019-11-06T21:41:06Z","snapshot_observed_at":"2026-08-17T11:53:46.758281Z","submitted_at":"2019-02-25T19:41:06Z","title":"Duality between density function and value function with applications in constrained optimal control and Markov Decision Process","version":3},"cited_work":{"arxiv_id":"1902.09583","doi":null,"metadata_source":"pith","pith_arxiv_id":"1902.09583","snapshot_observed_at":"2026-08-15T20:01:08.753450Z","title":"Duality between density function and value function with applications in constrained optimal control and Markov Decision Process","venue":"eess.SY","work_id":"b8138eec-3704-4560-866a-1be1f2d7669f","year":2019},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.427952Z"},"links":{"cited_paper":"/paper/1902.09583","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:59f8b567baef4e6c5eb093258e42a0158fbadfaf7104f2a4d830c423ecdbd84a","observation_id":"7910ef68-b089-4069-b9cd-2697d104341e","resolution":{"observed_at":"2026-08-15T20:01:08.759910Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.432595Z","title":"A tutorial on kernel density estimation and recent advances","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.432595Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:6357cc248bf8302caefe1e95bee34ad22115c6bd360ac95cd659e97e54bb881e","observation_id":"12714306-cb76-499b-9d89-0877225c6f86","resolution":{"observed_at":"2026-08-15T20:01:08.432595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.150205Z","title":"Supervised fuzzy reinforcement learning for robot navigation","venue":null,"work_id":"29659128-b0ee-4d07-a2a8-07e3e59fd070","year":2016},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.436678Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:e8b56b88697ca45f6d10000ce137ae4f1f50cb1c41b5dbb64b20f03ba5d53a43","observation_id":"7995c69f-1974-48c2-9d0b-468dcc0d49a7","resolution":{"observed_at":"2026-08-15T20:01:09.153865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.138661Z","title":"A comprehensive survey on safe reinforcement learning","venue":null,"work_id":"4919bf42-61d9-4410-85a9-29aad38daf91","year":2015},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.440861Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:c2d66f07c0f6d2a4c98ee3c93d679bdb78d8daa36a69fe2c80cfa64e0e622cb0","observation_id":"41d4d7a9-e90b-488a-b1c9-a3cff33419b5","resolution":{"observed_at":"2026-08-15T20:01:09.142245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.127215Z","title":"Fuzzy q-learning","venue":null,"work_id":"fad08922-b0f3-40d9-a01e-90590858431a","year":1997},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.445200Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:a6ed01464224e7d11bbdbbfd94c5f8517d4b329e79170a9482eac3b4a704aae7","observation_id":"ba56ffb1-40e2-42e6-9208-98fb0ce15ca4","resolution":{"observed_at":"2026-08-15T20:01:09.130738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.115626Z","title":"Deep reinforcement learning for robotic manipulation with asynchronous off-policy updates","venue":null,"work_id":"87391162-30d1-48c8-adf4-d672451afe1b","year":2017},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.449306Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:f4ef38811c5f4910b3f90f1012a454ced9342896545383b94f44c876e9dabdd0","observation_id":"de379194-4561-4849-b674-b63d3bf68da1","resolution":{"observed_at":"2026-08-15T20:01:09.119336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10330","last_updated":"2024-05-24T22:33:04Z","snapshot_observed_at":"2026-08-16T16:58:50.532049Z","submitted_at":"2022-05-20T17:42:38Z","title":"A Review of Safe Reinforcement Learning: Methods, Theory and Applications","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10330","snapshot_observed_at":"2026-08-15T20:01:08.453440Z","title":"A review of safe reinforcement learning: Methods, theory and applications","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.453440Z"},"links":{"cited_paper":"/paper/2205.10330","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:5674cf874798402ed8b2fc527dc5e06880b2cdeac654d44b0274840baf5bafc2","observation_id":"14b093ad-91a2-433a-9ab2-e4d41e255575","resolution":{"observed_at":"2026-08-15T20:01:08.453440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.08550","last_updated":"2020-11-03T05:46:51Z","snapshot_observed_at":"2026-08-10T20:40:57.457282Z","submitted_at":"2020-02-20T03:36:39Z","title":"Learning to Walk in the Real World with Minimal Human Effort","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.08550","snapshot_observed_at":"2026-08-15T20:01:08.458090Z","title":"Learning to walk in the real world with minimal human effort","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.458090Z"},"links":{"cited_paper":"/paper/2002.08550","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:bca547d479876525c0c4e9b04d4169e3c15990ab5db5cd249f415fd485c9ba15","observation_id":"88062e48-5473-4e2f-9530-f51adaf64026","resolution":{"observed_at":"2026-08-15T20:01:08.458090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.103195Z","title":"Hierarchical reinforcement learning for scarce medical resource allocation with imperfect information","venue":null,"work_id":"aaf35f24-9034-4359-ad08-6fa97e8ef82a","year":2021},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.462602Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:965514a45c0ee4ffa73b1b613ca47a1721a6e5f270c4405a8797ab49b01ac982","observation_id":"e3590007-a40a-422f-b7af-b26cb61e6b52","resolution":{"observed_at":"2026-08-15T20:01:09.107394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.08099","last_updated":"2019-02-16T18:11:58Z","snapshot_observed_at":"2026-08-15T23:37:26.174402Z","submitted_at":"2018-01-24T17:50:30Z","title":"Logically-Constrained Reinforcement Learning","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.08099","snapshot_observed_at":"2026-08-15T20:01:08.466900Z","title":"Logically-constrained reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.466900Z"},"links":{"cited_paper":"/paper/1801.08099","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:00ece10fc5f164075bb48c3e7b79b2a8a05b128f0de428a86f5a7525c91ee280","observation_id":"5e5fb747-f99f-4985-bc58-65a0d267616a","resolution":{"observed_at":"2026-08-15T20:01:08.466900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.090213Z","title":"Deep reinforcement learning with temporal logics","venue":null,"work_id":"18e31312-8046-4a26-886d-caf34c630107","year":2020},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.471573Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:299d018dc460ef599157ab21b0c4ee803e28b9cdc9c0a8d30991880e373155b2","observation_id":"82d539d9-c5d4-48c0-8671-88ab9ef72d1a","resolution":{"observed_at":"2026-08-15T20:01:09.094339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.077272Z","title":"Achieving sustainable supply chains through energy justice","venue":null,"work_id":"cb8c2d00-7545-44ab-8700-f8d7c6682dfd","year":2014},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.475627Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:f162f2b408d076b4af0f54bda94307b5b4df5262804bab95d581402bbc6ed8dd","observation_id":"89b97076-1a54-444e-a2d5-24564f2123b0","resolution":{"observed_at":"2026-08-15T20:01:09.081515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.064177Z","title":"Line: Logical query reasoning over hierarchical knowledge graphs","venue":null,"work_id":"7186db05-3fcb-49b9-8e8f-ec83e3f62994","year":2022},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.479956Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:ab007960c7ae8680f6e790878fa74a9ff52a5e2247363da5d3d31b5a4517d4f1","observation_id":"202b9f2b-0152-4143-9156-db1170c6accc","resolution":{"observed_at":"2026-08-15T20:01:09.068577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.051304Z","title":"America's strategy to secure the supply chain for a robust clean energy transition","venue":null,"work_id":"711654c4-946e-4c80-997c-7a9aa6684e08","year":2022},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.484102Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:14f229db6146f9cac12d913e2eee4674941d84e5d3d5a535c0622f20c4c237e2","observation_id":"8cdda88b-b8b6-45c6-9a1a-92f9d296e6da","resolution":{"observed_at":"2026-08-15T20:01:09.055482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.038305Z","title":"Community-based operations research","venue":null,"work_id":"8f34d7a7-c6f0-46ce-909e-1afe3129528c","year":2007},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.488583Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:52d5439908ba4d08de6b54b87c0dcd78e22148f66b6a8ee35605620e04967e0c","observation_id":"2084936b-8d76-41c1-99e3-3d9a89687a1e","resolution":{"observed_at":"2026-08-15T20:01:09.042539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.025148Z","title":"On bayesian index policies for sequential resource allocation","venue":null,"work_id":"82f34fd5-1f38-4a3b-9fc5-706d45e5ffd5","year":2018},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.492684Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:a71a45ee1155d3deebc0caa8e71363e42102d332e9ba875290af45cdc1a6a556","observation_id":"302212df-a0a1-43b2-b284-e203a09e1a88","resolution":{"observed_at":"2026-08-15T20:01:09.029257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:09.012320Z","title":"Between steps: Intermediate relaxations between big-m and convex hull formulations","venue":null,"work_id":"4e8af46e-9427-4fda-877a-976578b571e9","year":2021},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.496825Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:4febe25616298e1abfd041275cb980325021a729d106b49dfff81a6dba12e996","observation_id":"578cea17-3554-4b64-aeaa-41ceb3b279b5","resolution":{"observed_at":"2026-08-15T20:01:09.016571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.06298","last_updated":"2020-08-19T19:08:51Z","snapshot_observed_at":"2026-08-14T16:15:27.814749Z","submitted_at":"2019-06-14T17:10:42Z","title":"Augmenting Neural Networks with First-order Logic","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.06298","snapshot_observed_at":"2026-08-15T20:01:08.500522Z","title":"Augmenting neural networks with first-order logic","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.500522Z"},"links":{"cited_paper":"/paper/1906.06298","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:41144d4924453507df316922ef6dc030b766c83796a2be84f519aee0c943ccc5","observation_id":"c825ee03-52fb-44b7-bb5f-73b2dfd2e703","resolution":{"observed_at":"2026-08-15T20:01:08.500522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08560","last_updated":"2024-08-22T05:05:13Z","snapshot_observed_at":"2026-08-16T15:00:20.681996Z","submitted_at":"2023-09-15T17:28:06Z","title":"Deep Reinforcement Learning for Efficient and Fair Allocation of Health Care Resources","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08560","snapshot_observed_at":"2026-08-15T20:01:08.504544Z","title":"Deep reinforcement learning for efficient and fair allocation of health care resources","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.504544Z"},"links":{"cited_paper":"/paper/2309.08560","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:4b8b33ac1a63762219dbeea4a3480dcfb0a399cad5cab2b7838723c768e3cf44","observation_id":"6264bf78-637d-498b-91e9-5fc8dca917e0","resolution":{"observed_at":"2026-08-15T20:01:08.504544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.998473Z","title":"Sequential resource allocation for nonprofit operations","venue":null,"work_id":"b409b993-1d60-416d-b5af-364f8dd393da","year":2014},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.508841Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:24c874157c301ec2c1580d00f378fcb540871d9245315d552caf96d5cc33a420","observation_id":"a607d748-7a27-4367-9403-1aa91efb3936","resolution":{"observed_at":"2026-08-15T20:01:09.002610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.986316Z","title":"Clara: A constrained reinforcement learning based resource allocation framework for network slicing","venue":null,"work_id":"7b55bfe1-69fb-413a-9a11-b7c4399a3fff","year":2021},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.513144Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:b13d3465568048b921a9970048f88b974151492889c12b9928b97e589395ea6f","observation_id":"de61594b-3e94-43e1-b4d1-acbcbb0dfcc0","resolution":{"observed_at":"2026-08-15T20:01:08.990043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.974364Z","title":"Adaptive sequential surveillance with network and temporal dependence","venue":null,"work_id":"11e8fce6-5723-4048-9edf-41fa748ac984","year":2024},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.517342Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:530f9f751fcb88da05c6c39305c11dec92e1a484584cab684a078427465144ee","observation_id":"e973397e-f8a5-414d-9a06-5aebaba24179","resolution":{"observed_at":"2026-08-15T20:01:08.978102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.962339Z","title":"Ethical resource allocation in policing: Why policing requires a different approach from healthcare","venue":null,"work_id":"6013de6b-0d1b-4d24-a5f1-87a01c02c235","year":2024},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.521491Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:831fe133660b586fec0c9e3bd931346ad8338c54ea14a614098bce04d5d54005","observation_id":"80454cf3-ccc6-4a8d-b12b-b88fdd8c7b20","resolution":{"observed_at":"2026-08-15T20:01:08.966400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.950512Z","title":"A primal dual formulation for deep learning with constraints","venue":null,"work_id":"fbbf01c3-4de0-4836-9c9f-42a9539a7719","year":2019},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.525778Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:4b953fe383ec10e2a01948a81f7ef741aec085f95afb73cb32e4a4ad190ed2f4","observation_id":"acc5a0ff-d3ef-48f5-ba61-29a15f77d610","resolution":{"observed_at":"2026-08-15T20:01:08.954186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.937888Z","title":"Deep reinforcement learning approach for capacitated supply chain optimization under demand uncertainty","venue":null,"work_id":"9cf4897f-7d83-4594-81e6-95632d553dac","year":2019},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.529994Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:01df50842c409465f4007b60dbfd9959c0753cf849361b9b11f23a193ddc546b","observation_id":"b7567450-0cc4-47cc-a7f3-979a69769425","resolution":{"observed_at":"2026-08-15T20:01:08.942113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.924353Z","title":"Combining fuzzy logic and reinforcement learning for resource management in edge computing","venue":null,"work_id":"e547f725-ca09-4be5-acd0-7fc07ef4c566","year":2024},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.534280Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:898296bbb8fcc89fe18307b4aa24e99414315e3b289c42447a2ecec3bce353aa","observation_id":"92c40bbb-04a0-47f4-9bd7-c59d718e438c","resolution":{"observed_at":"2026-08-15T20:01:08.928679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.911293Z","title":"Fairness of the distribution of public medical and health resources","venue":null,"work_id":"324e31f2-465d-40ba-bd80-df3dd95ddde9","year":2021},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.538381Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:5e6c0747c1adf1b075c9176c50496afaea22c67bd0cf5d84aa0a2db64eb1d307","observation_id":"1dfc4132-eedb-4c26-8214-c3b69eec8098","resolution":{"observed_at":"2026-08-15T20:01:08.915694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.898520Z","title":"Density constrained reinforcement learning","venue":null,"work_id":"f52626d2-7273-46b2-96e0-7704f737b9e7","year":2021},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.542300Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:c043f24921b2b56b0ede92e4319b7bf7e930cb85c6ae29a36042b2aa895fa0f9","observation_id":"27eb12f5-e496-440d-a687-bebfd19efc97","resolution":{"observed_at":"2026-08-15T20:01:08.902621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.885361Z","title":"A dual to lyapunov's stability theorem","venue":null,"work_id":"b4c0e6c8-6eeb-45ec-91ce-b8027afddfa3","year":2001},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.547582Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:e66dc6c8e6343f34d107ffa627d8885fd4d8fa2eeb7ad5915e51d218bdb56945","observation_id":"a0b9784c-736f-40ce-88d7-21c4d9e15602","resolution":{"observed_at":"2026-08-15T20:01:08.889428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.872323Z","title":"Benchmarking Safe Exploration in Deep Reinforcement Learning","venue":null,"work_id":"83d11a12-f3c9-4523-9038-f6d669a6174a","year":2019},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.551759Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:53586b00aa0cccebd0a5bae009dbf3bb7a3060adc15db9e8b2836d611f1c812a","observation_id":"38398143-cf84-4274-b7c1-9790afab83c2","resolution":{"observed_at":"2026-08-15T20:01:08.876651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05969","last_updated":"2020-02-29T03:59:06Z","snapshot_observed_at":"2026-08-13T17:30:03.547401Z","submitted_at":"2020-02-14T11:20:10Z","title":"Query2box: Reasoning over Knowledge Graphs in Vector Space using Box Embeddings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05969","snapshot_observed_at":"2026-08-15T20:01:08.555712Z","title":"Query2box: Reasoning over knowledge graphs in vector space using box embeddings","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.555712Z"},"links":{"cited_paper":"/paper/2002.05969","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:3c5543fb70415902224b6fb5ceaf450efc8562f17916d807210af2095339ad23","observation_id":"2f1b0077-17c1-4454-9540-4155843d11e5","resolution":{"observed_at":"2026-08-15T20:01:08.555712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.858302Z","title":"Apprenticeship learning using linear programming","venue":null,"work_id":"a491a0cd-63ab-4668-ad9b-7265dcb3f9f1","year":2008},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.560069Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:8a8c1625e43119e7b32ad27e8f469992b4e2f73c05469b56fe30047623952ddc","observation_id":"133b02cf-616d-496b-90e0-9e10b66e26d4","resolution":{"observed_at":"2026-08-15T20:01:08.863196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.843736Z","title":"The impacts of the covid-19 traffic light system on staff in tertiary education in new zealand","venue":null,"work_id":"56a5a452-a097-47b5-bfe8-d92e266e22d0","year":2023},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.564114Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:2b5a46a4299a314dc99401c70daafce858508c15c394f111a4c3a1a077e524ea","observation_id":"c9d9f0ca-6b92-4be6-b98f-a1c9cd5c8665","resolution":{"observed_at":"2026-08-15T20:01:08.848622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.11074","last_updated":"2018-12-26T11:09:40Z","snapshot_observed_at":"2026-08-14T19:10:15.765536Z","submitted_at":"2018-05-28T17:31:11Z","title":"Reward Constrained Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.11074","snapshot_observed_at":"2026-08-15T20:01:08.568016Z","title":"Reward constrained policy optimization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.568016Z"},"links":{"cited_paper":"/paper/1805.11074","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:154632aff1b8f8bf9ce714661b367ff3dc3428a887a83c8df3804429851603e8","observation_id":"fe46283b-7b35-440a-9ffd-8a00c8395dcc","resolution":{"observed_at":"2026-08-15T20:01:08.568016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.829260Z","title":"Improved big-m reformulation for generalized disjunctive programs","venue":null,"work_id":"646d0aab-588d-469b-89bb-c924e9e8b63e","year":2015},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.572065Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:488208655762f3651d6884b8346a2b1fdd4e59762b0f2070f4a86c5382f3bd38","observation_id":"a1bfcaee-d873-4fde-ad75-fd784cc5df72","resolution":{"observed_at":"2026-08-15T20:01:08.833735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.815570Z","title":"Disjunctive programming techniques for the optimization of process systems with discontinuous investment costs- multiple size regions","venue":null,"work_id":"8db260bd-c781-4c6d-b2ec-b1d224e40bcf","year":1996},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.576006Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:ca90b16bd0d68400539b1e15fd5404e3e3c20a121f1f8061f178560c27c86426","observation_id":"9222da3e-c6b5-4756-a7ef-3f0fdf7b288c","resolution":{"observed_at":"2026-08-15T20:01:08.820024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.802860Z","title":"Dynamic shielding for reinforcement learning in black-box environments, 2022","venue":null,"work_id":"5043146d-c2f5-414d-a0d8-35bfe03d973e","year":2022},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.580100Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:15fc881300ea4b705ac40ea5b3a93588767f331b9df4b71be76f2b2a0481383d","observation_id":"ea06e07e-2147-4ac1-b132-57ad133fc53d","resolution":{"observed_at":"2026-08-15T20:01:08.806624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14758","last_updated":"2024-04-15T13:44:11Z","snapshot_observed_at":"2026-08-16T14:24:17.929668Z","submitted_at":"2024-01-26T10:33:38Z","title":"Off-Policy Primal-Dual Safe Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14758","snapshot_observed_at":"2026-08-15T20:01:08.584153Z","title":"Off-policy primal-dual safe reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.584153Z"},"links":{"cited_paper":"/paper/2401.14758","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:87844fe49c10cd7cf871fe4f07dfd013dd604a3a9fa18a2879e8246bc1af89c2","observation_id":"d1e43745-4fb0-4697-8826-476cac56d1cc","resolution":{"observed_at":"2026-08-15T20:01:08.584153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03152","last_updated":"2020-10-07T04:22:45Z","snapshot_observed_at":"2026-08-17T13:27:14.865751Z","submitted_at":"2020-10-07T04:22:45Z","title":"Projection-Based Constrained Policy Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03152","snapshot_observed_at":"2026-08-15T20:01:08.588304Z","title":"Projection-based constrained policy optimization","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.588304Z"},"links":{"cited_paper":"/paper/2010.03152","citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:3f55abdd57b9866bb5170967fa81d1bd47160f763c8269ad9281e9f169c64072","observation_id":"311564d5-b7e6-4960-aa54-f66b851479f6","resolution":{"observed_at":"2026-08-15T20:01:08.588304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.790690Z","title":"Learning density-based correlated equilibria for markov games","venue":null,"work_id":"5632205f-cff9-42a2-a1b3-692adb4bea56","year":2023},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.592377Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:f758b26ca466b199f32b5b8bcddb8409588477765c380f0dfb3a16f55e1c8e06","observation_id":"eb4687ca-97ae-4ace-86ec-c1b1c18c5817","resolution":{"observed_at":"2026-08-15T20:01:08.794529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.778092Z","title":"The energy injustice of hydropower: Development, resettlement, and social exclusion at the hongjiang and wanmipo hydropower stations in china","venue":null,"work_id":"8acef1c3-9e23-4e9a-aa01-415a95b064e2","year":2020},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.596286Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:1bb3aa1e2b0f2e91dd804b9cbbd9b8c7050da583f1a096fe83030fad30eed2e8","observation_id":"96cf58b7-de99-4668-9312-c989ccffde74","resolution":{"observed_at":"2026-08-15T20:01:08.782022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:01:08.600180Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T20:01:08.600180Z"},"links":{"citing_paper":"/paper/2506.14125"},"observation_digest":"sha256:b37ec337b5428f774d6f0d1bfe4db1b4bde9158cf3c112e90887a275b570b208","observation_id":"824a5941-4552-4a73-bb4b-6e728d9cc9b9","resolution":{"observed_at":"2026-08-15T20:01:08.600180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.14125","last_updated":"2025-06-17T02:40:49Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-15T23:38:05.275284Z","submitted_at":"2025-06-17T02:40:49Z","title":"Situational-Constrained Sequential Resources Allocation via Reinforcement Learning"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":1,"verified_fuzzy":37},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2506.14125."}