{"as_of":"2026-08-09T13:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fb2a8fce6e88c7ada54841643375ae0fb0e65997ba64bce400d606f59a373efb","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:32:04.280424Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T18:22:36.891186Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T03:09:30.118345Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"cited_work":{"arxiv_id":"2506.02255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02255","snapshot_observed_at":"2026-07-17T00:20:38.825561Z","title":"Papageorgiou, and Can Li","venue":null,"work_id":"94d1bb09-c17a-4474-89eb-f4eab4d04c6d","year":2025},"citing_paper":{"arxiv_id":"2606.20376","last_updated":"2026-06-19T22:06:44Z","snapshot_observed_at":"2026-08-06T18:52:58.568196Z","submitted_at":"2026-06-18T15:36:13Z","title":"CRAX: Fast Safe Reinforcement Learning Benchmarking","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T18:22:36.891186Z"},"links":{"cited_paper":"/paper/2506.02255","citing_paper":"/paper/2606.20376"},"observation_digest":"sha256:f551abc3ed817b2d48ccbeb214cadaf8d1b003e855e7a254900ac0707c3507ba","observation_id":"4e50de92-f92c-4dfa-82c0-8feea0a431a5","resolution":{"observed_at":"2026-07-17T00:20:38.825561Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02255/citation-record","integrity":"/paper/2506.02255/integrity","json":"/paper/2506.02255/citation-record.json","paper":"/paper/2506.02255"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:10.471140Z","title":"Constrained policy optimization","venue":null,"work_id":"8e4e1aa9-51af-4314-a487-71a80b6fdefa","year":2017},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:00.771822Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:5e8861dd6a5b92bb622e07ddf1cd4873966ceddce2b13ff1ec850c9ea5e01a43","observation_id":"61b4bb19-aa9d-40ad-9e7b-29e8d07e1ae0","resolution":{"observed_at":"2026-08-07T11:32:10.596282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:00.846267Z","title":"Routledge, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:00.846267Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:d742eae127b483c71baddbdf62fe35479bebb54a1ce6f4bd43083bb8cf97c77f","observation_id":"963558d4-3461-40c8-8890-0340c2d8b3f9","resolution":{"observed_at":"2026-08-07T11:32:00.846267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22093","last_updated":"2024-12-05T15:35:59Z","snapshot_observed_at":"2026-07-06T19:41:32.754401Z","submitted_at":"2024-10-29T14:49:26Z","title":"PC-Gym: Benchmark Environments For Process Control Problems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22093","snapshot_observed_at":"2026-08-07T11:32:00.933042Z","title":"PC-Gym: Benchmark Environments for Process Control Problems.arXiv preprint arXiv:2410.22093,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:00.933042Z"},"links":{"cited_paper":"/paper/2410.22093","citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:c4ccad0f9dd15648b236a91bddf51a3633d52220baa5c42d1c1d390c94479ea0","observation_id":"82110d89-acf1-4b2c-af1e-78bf1524618b","resolution":{"observed_at":"2026-08-07T11:32:00.933042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-07T11:32:01.071746Z","title":"OpenAI Gym.arXiv preprint arXiv:1606.01540, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:01.071746Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:3d4a99a1165db122a9608d4ec70ed88dfb86e7d2a8f2415ae93379c692cb6d04","observation_id":"c823ab86-d027-4433-a3cf-573586a4c857","resolution":{"observed_at":"2026-08-07T11:32:01.071746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:01.098289Z","title":"Constante Flores, and Can Li","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:01.098289Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:e79c085e2771f4eebaa92807d64709bda6e536af79f3de80d5855e44f9164446","observation_id":"d19c23c3-1c0d-4e9b-8d34-ec6f43937918","resolution":{"observed_at":"2026-08-07T11:32:01.098289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10898-020-00882-3","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:04.738122Z","title":"Maravelias","venue":null,"work_id":"f0e6d493-e80e-4d87-83d3-68206e7e37a3","year":2020},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:01.173648Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:a4a6051db37438168f3bc1aeafef5054a4a2a2353ca86c21e9f06f934f76316b","observation_id":"ee78dae1-61cb-49f1-bbb7-9ea60b2bdecb","resolution":{"observed_at":"2026-08-07T11:32:04.764384Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:01.262174Z","title":"A comprehensive survey on safe reinforcement learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:01.262174Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:4087e0ac9c3416849cd94407e1a1b09118a1df06d36531665126d624ef24c0f6","observation_id":"680d83cb-0584-4604-a0a6-662a7859c9c2","resolution":{"observed_at":"2026-08-07T11:32:01.262174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10330","last_updated":"2024-05-24T22:33:04Z","snapshot_observed_at":"2026-08-04T09:15:33.903637Z","submitted_at":"2022-05-20T17:42:38Z","title":"A Review of Safe Reinforcement Learning: Methods, Theory and Applications","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10330","snapshot_observed_at":"2026-08-07T11:32:01.311859Z","title":"A review of safe reinforcement learning: Methods, theory and applications.arXiv preprint arXiv:2205.10330, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:01.311859Z"},"links":{"cited_paper":"/paper/2205.10330","citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:0089390009d07d2e3fdb59b59a27daa7f7f9e09143a601cc662ff07f50ef1cfb","observation_id":"0d6cb76d-128d-48dc-990e-0fad61852665","resolution":{"observed_at":"2026-08-07T11:32:01.311859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:01.369592Z","title":"Gurobi Optimizer Reference Manual, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:01.369592Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:29a32e04cee3bc942af31b476450775d1a61677d6050288fa0ca5e1004a26565","observation_id":"024bc4db-08ee-4953-a254-d6e1a5179c1e","resolution":{"observed_at":"2026-08-07T11:32:01.369592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.ejor.2020.03.036","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:04.600572Z","title":null,"venue":null,"work_id":"3fa8f9d9-b4f8-4765-82fe-f70bf0003342","year":2020},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:01.440410Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:3e970890a3b5105f3cf424b642e460d4c623d066c336c4e1f695ff66467f1651","observation_id":"20ba0d41-55b6-4493-b7e8-10874879b2f8","resolution":{"observed_at":"2026-08-07T11:32:04.653160Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.06319","last_updated":"2020-10-17T11:58:49Z","snapshot_observed_at":"2026-08-09T06:55:50.356229Z","submitted_at":"2020-08-14T12:21:22Z","title":"OR-Gym: A Reinforcement Learning Library for Operations Research Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.06319","snapshot_observed_at":"2026-08-07T11:32:01.514345Z","title":"Hubbs, Hector D","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:01.514345Z"},"links":{"cited_paper":"/paper/2008.06319","citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:cc669f1ebc82a43e7824c23e75e930b42b6404ee33932b74eebea63ef125c32a","observation_id":"31a9d86d-a3df-45f2-b106-3fa6dc851621","resolution":{"observed_at":"2026-08-07T11:32:01.514345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12932","last_updated":"2025-03-17T08:41:43Z","snapshot_observed_at":"2026-08-07T16:58:42.375547Z","submitted_at":"2025-03-17T08:41:43Z","title":"Efficient Action-Constrained Reinforcement Learning via Acceptance-Rejection Method and Augmented MDPs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12932","snapshot_observed_at":"2026-08-07T11:32:01.612049Z","title":"Efficient action-constrained reinforce- ment learning via acceptance-rejection method and augmented mdps.arXiv preprint arXiv:2503.12932, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:01.612049Z"},"links":{"cited_paper":"/paper/2503.12932","citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:1d94c9214dce9b5c6ed9f9f68ab79990ab7cf56180a3b41acca26eab62ba41f9","observation_id":"1e561115-3525-4ff6-88bf-b71c567e5bdc","resolution":{"observed_at":"2026-08-07T11:32:01.612049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:01.701692Z","title":"Safety gymnasium: A unified safe reinforcement learning benchmark.Advances in Neural Information Processing Systems, 36:18964–18993, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:01.701692Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:0a297a3bc0c4fd5b3efa03a51a52ecb5be39987a045e9f055ead0eaecee35566","observation_id":"4e1578fa-907d-4623-97db-674db1d53f0a","resolution":{"observed_at":"2026-08-07T11:32:01.701692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:01.782684Z","title":"Omnisafe: An infrastructure for accelerating safe reinforcement learning research.Journal of Machine Learning Research, 25(285):1–6, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:01.782684Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:e32d3d551b507f8baea8303c0fbd5c98426649d6437f84380b0e14ff0b5b60f9","observation_id":"ec2fdcb9-ea61-4159-965a-9e15b5878c45","resolution":{"observed_at":"2026-08-07T11:32:01.782684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:01.849797Z","title":"On mixed-integer programming formulations for the unit commitment problem.INFORMS Journal on Computing, 32(4): 857–876, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:01.849797Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:9746f495976a5bb0684c94b106a6df5b50dad70675da943abd0939612dd47f36","observation_id":"b35bab0a-a797-430a-ab8b-3df32a2e304d","resolution":{"observed_at":"2026-08-07T11:32:01.849797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:10.290408Z","title":null,"venue":null,"work_id":"0876939c-675d-4ca8-8089-4842ceb4688f","year":2022},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:01.970272Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:4065f8cb769e37bacfdbd29554d0e2d39a5d79fe1bb70e59beb1d1ee04f56e85","observation_id":"e585d979-abf4-48c6-910c-94d51daf0329","resolution":{"observed_at":"2026-08-07T11:32:10.371027Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:10.154014Z","title":"Lillicrap, Jonathan J","venue":null,"work_id":"5b7fc24e-c818-42e2-a7ab-4aef8e7496e1","year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:02.060041Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:6fe6b88122d2b0b147930ef37d7f675db788a2d7be800e5b78eb6b0940f72753","observation_id":"bbac67ff-0281-41d0-b213-0ded30ee4408","resolution":{"observed_at":"2026-08-07T11:32:10.250450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:10.013681Z","title":"Unified frameworks for optimal process planning and scheduling","venue":null,"work_id":"f5531020-df0a-4dfa-8702-a90e973ee809","year":1994},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:02.187237Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:de04db9d1e7e1988a6fd3a8770680bc29040a3d5fbfc3ae8a720d7d787ee3909","observation_id":"23147806-69be-4b36-b7f8-da24b011e394","resolution":{"observed_at":"2026-08-07T11:32:10.072484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:09.845524Z","title":"Reinforcement learning for process control: Review and benchmark problems.International Journal of Control, Automation and Systems, 23(1):1–40, 2025","venue":null,"work_id":"d6aba437-2f1d-4faa-99f6-320a53f8f7ef","year":2025},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:02.272017Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:a118d1e7b0bb42a814ea53e4c90b0f69b1abe36c5c12feba009a8b3dd03369a3","observation_id":"0c3ecbaf-e821-40ce-a2bb-a98e951c56aa","resolution":{"observed_at":"2026-08-07T11:32:09.922915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:09.590055Z","title":"Algorithmic approaches to inventory management optimization.Processes, 9(1):102, 2021","venue":null,"work_id":"79cf113d-1788-4011-9f78-8e19355692b0","year":2021},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:02.333051Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:a0f8f9ae319888aa1de65baed0fec5db672baae04d479b61690501f8c7c4e5ba","observation_id":"35520a46-a229-483c-b386-37c74047544b","resolution":{"observed_at":"2026-08-07T11:32:09.686849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/en17092167","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:04.479146Z","title":"Re- inforcement learning for efficient power systems planning: A review of operational and ex- pansion strategies.Energies, 17(9), 2024","venue":null,"work_id":"c91a679c-73e2-4da0-a057-ab412817a636","year":2024},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:02.435302Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:39655160b600f3428676d7d21157be8deb616968cd70333d8b9d9bfef22b3623","observation_id":"bcebe945-e01f-43c5-bcfe-400da2d02b52","resolution":{"observed_at":"2026-08-07T11:32:04.541133Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12296","last_updated":"2024-04-21T16:05:13Z","snapshot_observed_at":"2026-07-06T18:02:15.186390Z","submitted_at":"2024-04-18T16:19:10Z","title":"Long Duration Battery Sizing, Siting, and Operation Under Wildfire Risk Using Progressive Hedging","version":2},"cited_work":{"arxiv_id":"2404.12296","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.12296","snapshot_observed_at":"2026-08-07T11:32:05.034883Z","title":"Long Duration Battery Sizing, Siting, and Operation Under Wildfire Risk Using Progressive Hedging","venue":"eess.SY","work_id":"a626d218-0914-4dd0-a6fb-6f9817cce67a","year":2024},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:02.514632Z"},"links":{"cited_paper":"/paper/2404.12296","citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:d2633b48c1c1d4140f0da6856d5a37dd814778a6239272cbef9c231f6868c119","observation_id":"b67f19cf-3384-4bbc-a372-6bd119fec031","resolution":{"observed_at":"2026-08-07T11:32:05.151515Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20568","last_updated":"2025-03-24T13:43:28Z","snapshot_observed_at":"2026-08-07T17:41:30.791058Z","submitted_at":"2025-02-27T22:15:55Z","title":"A Tutorial on Multi-time Scale Optimization Models and Algorithms","version":2},"cited_work":{"arxiv_id":"2502.20568","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.20568","snapshot_observed_at":"2026-08-07T11:32:04.932719Z","title":"A Tutorial on Multi-time Scale Optimization Models and Algorithms","venue":"math.OC","work_id":"c3f21c73-7681-4e8c-99a1-c857a592f474","year":2025},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:02.599613Z"},"links":{"cited_paper":"/paper/2502.20568","citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:806411f13baa2b31ceaa455be2c43fc7dc73903cdb0c3fbf2bb34f99139863a2","observation_id":"d4e0ec13-29eb-46fa-885a-dd9bc7e0cb1c","resolution":{"observed_at":"2026-08-07T11:32:04.951229Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:09.381249Z","title":"Prentice Hall Upper Saddle River, NJ, 1998","venue":null,"work_id":"f06eb8f9-ecd9-4fc7-808e-0360fbbada55","year":1998},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:02.686982Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:ff74cce67b4bdb2a9bfcb6f8b1084faf0058b6c5a4a6065b29bbecf3e337ee9e","observation_id":"9c6730b4-5401-417d-a511-01f3d0bcbf6a","resolution":{"observed_at":"2026-08-07T11:32:09.489857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:09.175531Z","title":"Benchmarking Safe Exploration in Deep Reinforcement Learning","venue":null,"work_id":"1b13991f-8203-438c-9b48-e6bb9fcb80f0","year":2019},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:02.757810Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:abb316d2bc18cf1cfb73770b13b3c45044e2fa122e12ec18e883fe9298c9ca82","observation_id":"e78abb14-1057-4130-8668-4f583eacd316","resolution":{"observed_at":"2026-08-07T11:32:09.260888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:08.965743Z","title":"Trust region policy optimization","venue":null,"work_id":"82c2f5e8-cb57-408d-9fbd-f1e5a958ebfc","year":2015},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:02.827275Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:0e56786c3342f7d60c2960053920daf76e0ea084079ab7ddf8560ca990e73721","observation_id":"45547f6f-583e-49d8-8256-14b22f7b90fe","resolution":{"observed_at":"2026-08-07T11:32:09.067408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:02.936228Z","title":"MuJoCo: A physics engine for model-based control","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:02.936228Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:636401351945efe0242ec8fd3f374551d46c6c35a8a5369baaab9bcda2646d97","observation_id":"b039c111-175d-4152-8354-d51e969a8161","resolution":{"observed_at":"2026-08-07T11:32:02.936228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.compchemeng.2015.08.008","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:04.389160Z","title":"Xenos, Georgios M","venue":null,"work_id":"78351f2b-625e-490a-b2e0-8afd7b8a094e","year":2016},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:03.009205Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:3a31238ff11df7a01bd076baea2321ae96c88e137e5ed2b94164837803052cda","observation_id":"508b018d-30e7-40bb-9518-79a7f0f4c175","resolution":{"observed_at":"2026-08-07T11:32:04.419329Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:08.786219Z","title":"Crpo: A new approach for safe reinforcement learning with convergence guarantee","venue":null,"work_id":"13b7fff9-9be7-4b69-b97a-f5862cd9a4dd","year":2021},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:03.095482Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:a3510d510c72605d1941aaec5640e3db9b149e34ef291e8560bc628cde85f5c6","observation_id":"0be6881f-ab1c-40c5-8c0c-49ea42d7d187","resolution":{"observed_at":"2026-08-07T11:32:08.857888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:08.631033Z","title":"Sustaingym: Reinforcement learning environments for sustainable energy systems.Advances in Neural Information Processing Systems, 36:59464–59476, 2023","venue":null,"work_id":"ea609934-ab5d-46d2-98f7-915ad43fd5c5","year":2023},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:03.175365Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:cda9dd560e2d884e049f2a794385830f392e65c55f53f18d7aa96edb8283ed20","observation_id":"419a0363-ada2-44ae-b4be-f89978500c28","resolution":{"observed_at":"2026-08-07T11:32:08.703573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:08.457973Z","title":"Penalized proximal policy optimization for safe reinforcement learning","venue":null,"work_id":"ed10c337-42d6-436b-99cd-eeec368f322a","year":2022},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:03.230262Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:0229e20eb056ec96da0298640395181a78636ee97eb067a0538713b33b911d6b","observation_id":"6bc3645a-7918-4151-a5ee-b4b84385df62","resolution":{"observed_at":"2026-08-07T11:32:08.552714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:03.274856Z","title":"Grossmann, Clara F","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:03.274856Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:ec2ad7571f3a59274e9b802970bc61a4581b8d95c70fdaf8728c6cacadaeabed","observation_id":"1012ca51-be2a-4e4b-8f96-61003b4a8176","resolution":{"observed_at":"2026-08-07T11:32:03.274856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:08.257095Z","title":null,"venue":null,"work_id":"0a4b22ec-f723-4126-b685-a27ac1508102","year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:03.377485Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:856d5cbd04a331837ca160c66a68587b084acde23c819246b7bcab3fdec7fa97","observation_id":"8740be19-5a77-4434-be49-9c9ffdbc7b34","resolution":{"observed_at":"2026-08-07T11:32:08.336676Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:08.102447Z","title":"Xr,t+1 =X r,t +p t,r,0 pt =p t−1,r,1:τmax ⊕ X i max{νi,r,0} ·afinal i,t (1)","venue":null,"work_id":"306276bc-6057-4f04-b2a6-cb8de562593d","year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:03.475255Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:e12a5082f0d6fc1d139fb663e0dd84eb6de9d0b52d9dd82bdaab97541c8c5685","observation_id":"e18a99ec-4f9b-4b20-8af8-d3c86fef6598","resolution":{"observed_at":"2026-08-07T11:32:08.175147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:07.927850Z","title":"A part of the cost is calculated based on this","venue":null,"work_id":"20d471b0-2bb8-44c1-aae9-2b4b511bea8a","year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:03.579547Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:16ae36eeca71e7cf06364c5fd3777119705ffcf30efb1f95d8636b845062cb61","observation_id":"74867053-cea8-485b-8367-2d8f63739cc8","resolution":{"observed_at":"2026-08-07T11:32:08.022092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:07.749912Z","title":null,"venue":null,"work_id":"bc2f145f-fa5b-4d6a-b755-cb66667df8fd","year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:03.676758Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:681c93382273d1d246fae7608712d5bc8c0ee89699f41e38af73bfc12167f9b6","observation_id":"8ac320ab-4e1f-409f-a827-fa1f2d6c8b12","resolution":{"observed_at":"2026-08-07T11:32:07.861052Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:07.572034Z","title":"Xs,t+1 =X s,t +p t,s,0 pt+1,s =p t,s,1:τmax ⊕ X e X i max(νi,s,0)·a final i,e,t (2)","venue":null,"work_id":"3b4b223f-07b7-40f5-836a-459697ba7a03","year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:03.723543Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:23ff5bbaedbd248e64c3950e23b27004f1e0e9f7d2ff14f4bcf0a04ae86c9972","observation_id":"29c3ff90-a4fb-4af6-9131-99cab3040995","resolution":{"observed_at":"2026-08-07T11:32:07.655416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:07.346540Z","title":"Violations of these bounds contribute to the constraint cost","venue":null,"work_id":"9f7d40c1-c00b-43f3-822d-d0ae0d5c17c2","year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:03.810716Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:4543f0b8335db3074401a7fb7c2616121eeb3c10cc3c6d5d29f95b957d5fd798","observation_id":"993405ec-c93c-4a6d-bf64-a2da5dec5d97","resolution":{"observed_at":"2026-08-07T11:32:07.473629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:07.142888Z","title":"33 Sales and Backlog Update.Sales are Sr,m,t = min Dr,m,t +B r,m,t−1, Ir,t , then Ir,t ←I r,t −S r,m,t, B r,m,t =D r,m,t +B r,m,t−1 −S r,m,t","venue":null,"work_id":"65c0a430-b26f-4731-b799-2f154b5cc961","year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:03.876922Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:730ef472158ed5fd4fdcf7633dad6b2e4163cbe1a2ad7350a0b37f5b70d13d37","observation_id":"e33421c7-3ebc-47b7-9b74-f555aa4649b2","resolution":{"observed_at":"2026-08-07T11:32:07.243614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:06.861367Z","title":"Let the resulting action vector be at = pg,t g∈G ∥ cn,t n∈N ∥ pd n,t n∈N ∥ ℓn,t n∈N ∥ θn,t n∈N \\{1}, withθ 1,t ≡0","venue":null,"work_id":"529ce412-b490-4ddc-a67a-34019358ca67","year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:03.906905Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:4b9e8f314c1d208587dbd5b8b56b656e25c54dafd47bc62a627ff9a564a0ecb8","observation_id":"23e14cd6-1a62-4585-9abf-5b071a58c012","resolution":{"observed_at":"2026-08-07T11:32:06.997162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:06.527011Z","title":null,"venue":null,"work_id":"fbd2c069-fbc5-42c3-96c8-940cd1699deb","year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:03.949187Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:3fba49abb98df05f50980bed079080c302f1e509a28a073f9f03d28c4c7d20f2","observation_id":"6008c2d5-8dbe-465f-8d6b-103554c18471","resolution":{"observed_at":"2026-08-07T11:32:06.670757Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:06.356422Z","title":null,"venue":null,"work_id":"a26b1ddf-692e-4b13-a4f0-7858d999d67c","year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:04.025750Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:cc3548ad96cdc17d68fbfea5414a61a0f612e724e8c730bc751746266ac02bd8","observation_id":"431340fe-5d2a-44c8-8f7a-2f19f3598bea","resolution":{"observed_at":"2026-08-07T11:32:06.437399Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:06.053253Z","title":null,"venue":null,"work_id":"8c4e99e4-b6e2-48a9-85c9-9349c2def629","year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:04.075692Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:8d573b7556dc1b52b9909b6ed1dbe4897abbba8060259c3b53acf909513cfcc0","observation_id":"5fe802bd-14c4-4f32-a3f6-cb8466165ef4","resolution":{"observed_at":"2026-08-07T11:32:06.218668Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:05.801078Z","title":null,"venue":null,"work_id":"1668ae05-26de-4d4b-be81-19b05af344e3","year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:04.146138Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:ec79b58692a6fc9724be9ef054e7dee416611a61df5c08a3b73a5b3ee7e93085","observation_id":"bcad44a6-12a6-4714-85be-14f6c2e3603e","resolution":{"observed_at":"2026-08-07T11:32:05.934491Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:05.565866Z","title":"The nodal power-balance residual is: ∆n,t =P n,t − X j∈N Bnj(θn,t −θ j,t), and the network-balance penalty is: C bal t =ϕ bal X n∈N |∆n,t|","venue":null,"work_id":"729c3679-ede8-49cb-aa4c-87953f1361f1","year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:04.215700Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:81fd27f6b84ce3a3fd090586c1284238e2df5f38e27efd10c3220bb7b9f91e21","observation_id":"c1a6870d-ba19-4f04-9529-4bafb4747b26","resolution":{"observed_at":"2026-08-07T11:32:05.667389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:32:05.373468Z","title":"Work” (active production) and “Off","venue":null,"work_id":"1350e208-906c-4f17-89a3-0e578fe8692d","year":2000},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:04.280424Z"},"links":{"citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:7caf9778cdfce2c00674483f69ea2dedc547803012d593c39bfa83cccce439ef","observation_id":"85772ac9-40e5-4cf9-ad58-e4810ee2e5fb","resolution":{"observed_at":"2026-08-07T11:32:05.423083Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-07T11:32:02.130807Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:02.130807Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:58ab85102360850c9d5e50f5882f0ab0ef9737e86ff62a8d1d2260e0d947ad8c","observation_id":"1e789084-1a41-45d8-85ca-099a04c35cb8","resolution":{"observed_at":"2026-08-07T11:32:02.130807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22093","last_updated":"2024-12-05T15:35:59Z","snapshot_observed_at":"2026-07-06T19:41:32.754401Z","submitted_at":"2024-10-29T14:49:26Z","title":"PC-Gym: Benchmark Environments For Process Control Problems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22093","snapshot_observed_at":"2026-08-07T11:32:01.018749Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:01.018749Z"},"links":{"cited_paper":"/paper/2410.22093","citing_paper":"/paper/2506.02255"},"observation_digest":"sha256:db04da2a257dc7a46753be1f03894167a1429935024675a76ababe357b9f1ce5","observation_id":"46015323-1c64-40a8-8f4c-587787a22b41","resolution":{"observed_at":"2026-08-07T11:32:01.018749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02255","last_updated":"2026-07-16T00:21:54Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T11:25:20.437026Z","submitted_at":"2025-06-02T20:59:45Z","title":"SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":6,"verified_fuzzy":18},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2506.02255."}