{"as_of":"2026-08-16T05:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:16eb4b4a723c769db1e520990162018b192ebe4778872803617a960c7c4a8eb3","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:54:45.769653Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03409/citation-record","integrity":"/paper/2608.03409/integrity","json":"/paper/2608.03409/citation-record.json","paper":"/paper/2608.03409"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.509452Z","title":"A large-scale high- resolution geographic analysis of impacts of electric vehicle charging on low-voltage grids,","venue":null,"work_id":"840c3054-4e6e-4434-ab13-91821ae9bbf3","year":2022},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.562570Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:882a144d4eea4a25a1c96ca08502a8b350acf826eda2b9784ed7ae943140dd9b","observation_id":"256d0020-e4b0-4efe-9bf1-8c2bbe146aba","resolution":{"observed_at":"2026-08-15T14:54:46.517596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.488672Z","title":"An investigation of plug-in electric vehicle charging impact on power systems scheduling and energy costs,","venue":null,"work_id":"d341994a-fe9c-491e-89f0-62e7c78b59c8","year":1902},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.568834Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:77caf3d7870968e21e40417349edb76dec1ad9e5640d6bf746f0312a7e304b18","observation_id":"fc693326-db97-425f-a924-956325ee4332","resolution":{"observed_at":"2026-08-15T14:54:46.495939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.469963Z","title":"A non-iterative de- coupled solution of the coordinated robust opf in transmission and distribution networks with variable generating units,","venue":null,"work_id":"602585ff-b0c2-4d24-a7c6-ce29518fdf0e","year":2019},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.574686Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:f05010c297012f7efae5f280df47ac2a1041d74d5f0275dc133d364ea037e239","observation_id":"21232e31-cccd-440b-8360-9ae286a32679","resolution":{"observed_at":"2026-08-15T14:54:46.476132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.450881Z","title":"Two-stage optimization for efficient v2g coordination in distribution power system,","venue":null,"work_id":"9f10fe80-85b1-4e8c-b770-19173bac0e89","year":2024},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.583164Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:42248860df5ffeef0103eb607461ce1c87fe01029ec45d1de69448cde0b8968e","observation_id":"3f1e2ad6-b3e6-44cc-a30f-4d55b950dd38","resolution":{"observed_at":"2026-08-15T14:54:46.457122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.432282Z","title":"Complexity of branch- and-bound and cutting planes in mixed-integer optimization—ii,","venue":null,"work_id":"894bf508-9aba-4e8c-a78c-b7aa09735ecb","year":2022},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.590495Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:9a2fa2e5388ca8f5011e378c5ac93b8e9b1728ba6b8facbc26948ca6ca73dccd","observation_id":"b5f97872-9c8a-4f6f-a0e5-abe39017e2d2","resolution":{"observed_at":"2026-08-15T14:54:46.437833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.413020Z","title":"Route planning for a fleet of electric vehicles with waiting times at charging stations,","venue":null,"work_id":"de65917f-8218-41fd-8773-5b166d0438f2","year":2019},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.597595Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:b8f7d9a76f3268f2a3f62e59bbc4227091f7fcc6c8cbfc7b1661a3f83fcef751","observation_id":"ad49ae71-7ea5-4521-b690-9da4ca2182f0","resolution":{"observed_at":"2026-08-15T14:54:46.419621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.388334Z","title":"Optimized in- tegration of electric vehicles in low voltage distribution grids,","venue":null,"work_id":"3f461e6c-bcab-4ad5-a6f4-2482be2fcb09","year":2019},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.605048Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:82025025a541ec27dd8f2c0b19197eae6227ba2bd8ddf7dc85c4b2bd4b996f49","observation_id":"8d4fea9c-29f2-4c11-89ca-fd5e2ce4f25a","resolution":{"observed_at":"2026-08-15T14:54:46.396777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.367054Z","title":"Model predic- tive control for smart grids with multiple electric-vehicle charging stations,","venue":null,"work_id":"c2a38659-4b2a-4150-9742-20abf0e9fcf1","year":2018},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.612180Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:b619a1aadbad1ddbe1c8e080c1b77492a2cd1bd604128771df33847b203778e9","observation_id":"b49149ec-302f-4fb0-adfc-da68757a5001","resolution":{"observed_at":"2026-08-15T14:54:46.372447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.348162Z","title":"Deepopf: deep neural networks for optimal power flow,","venue":null,"work_id":"073e60ff-e7c9-42bb-a5d1-595dcc732bde","year":2021},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.618722Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:0ccf974a0466e1290ea0e3e8b723bacd13cc4c8b93df8114ebd3efe036878069","observation_id":"f5ca329b-5963-4b51-977a-7ac47f0a7f7c","resolution":{"observed_at":"2026-08-15T14:54:46.353819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.329721Z","title":"Physics-informed reinforcement learning for real-time optimal power flow with renewable energy resources,","venue":null,"work_id":"601477ab-84b5-4028-a51f-e512cee533bf","year":2024},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.623625Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:4dc591a9c75697116be27288a713e750263f3ce2a2524e39a461053289852752","observation_id":"53fe6fb2-f5c0-4f58-a3a6-a49a9b0d500c","resolution":{"observed_at":"2026-08-15T14:54:46.335399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.311103Z","title":"Physics-informed graphical representation-enabled deep reinforcement learning for robust distribu- tion system voltage control,","venue":null,"work_id":"be305d73-6c18-48ba-af0f-84a618030621","year":2023},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.628490Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:9269a0395bc158f741f2e7ec83be9f5751585ef9aad42266babf62ddf15a59d5","observation_id":"1480f790-8882-4ae3-addb-1f7c744b35af","resolution":{"observed_at":"2026-08-15T14:54:46.316165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.291861Z","title":"Learning to operate an electric vehicle charging station considering vehicle-grid integration,","venue":null,"work_id":"ab6af620-1a61-40b6-a144-65c2c18aef4e","year":2022},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.634105Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:077f1302370e139ae66b2cdc22080ad76fa282236f4f0519c2c134d0237de790","observation_id":"01146db5-108e-40c8-a04e-611c26047580","resolution":{"observed_at":"2026-08-15T14:54:46.297969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.267266Z","title":"Definition and evaluation of model-free coordination of electrical vehicle charging with reinforcement learning,","venue":null,"work_id":"a7b5ec9a-172b-4a2d-aa46-6601a9372376","year":2019},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.639185Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:5d143d148185385e5c3e676581bec2e6f4432e16071177c08503456b68b2243f","observation_id":"eddcd866-e5c5-4465-8401-7e6c9579f1c9","resolution":{"observed_at":"2026-08-15T14:54:46.273846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.248082Z","title":"Safe off-policy deep reinforcement learning algorithm for volt-var control in power distribution systems,","venue":null,"work_id":"e73d6f21-56cc-41d7-bace-ebeaa9fd116a","year":2019},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.644236Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:6fb3de535c93739fd94c482ee032c5b2cd7adad1c90a0deeaeaeebbb5f6c43df","observation_id":"b7c218d5-1dde-4189-9c23-76de3870a405","resolution":{"observed_at":"2026-08-15T14:54:46.254168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.227296Z","title":"A hybrid data-driven method for fast solution of security- constrained optimal power flow,","venue":null,"work_id":"fe5a9a80-c599-4cb3-92f9-bbbfb7645c73","year":2022},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.649622Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:60ff63369051e57191596f64bda39259d39d41718345210682661146a818b696","observation_id":"75ee2575-63f0-4371-8b6a-6594c532f81f","resolution":{"observed_at":"2026-08-15T14:54:46.232979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.201497Z","title":"Safe deep reinforcement learning- based constrained optimal control scheme for active distribution networks,","venue":null,"work_id":"5171183c-a9e0-40ca-a28a-1e04805dfb8f","year":2020},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.657192Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:623427eb6d4087b868fbc80cdc22d67283401593e235c73323e123af6b8a8379","observation_id":"1b99eee8-e3cc-462d-a766-1ff0ffe22247","resolution":{"observed_at":"2026-08-15T14:54:46.208457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.180218Z","title":"Model-augmented safe reinforcement learning for volt-var control in power distribution networks,","venue":null,"work_id":"abdfecb7-ca39-49d1-b2fa-ad04b670fa1e","year":2022},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.663757Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:c2aca5394850d7d06b2d37b52e05fbb9ee6575ceb2787cedb80a052a2b68d6e2","observation_id":"b968d31d-0d61-43f6-9cf3-efd6820ede78","resolution":{"observed_at":"2026-08-15T14:54:46.187898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.161693Z","title":"A safe policy learning-based method for decentralized and economic frequency control in isolated networked-microgrid systems,","venue":null,"work_id":"104de509-5a33-40d7-a159-371d96d9175f","year":1982},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.669662Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:7d0e9d7f663e647fe34c6207e07d97eeb1eff9d3eba42075db460ab57f33cc43","observation_id":"1bff50c7-950b-49c3-b006-5778510eef5c","resolution":{"observed_at":"2026-08-15T14:54:46.168222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.143506Z","title":"Deepopf: A deep neural network ap- proach for security-constrained dc optimal power flow,","venue":null,"work_id":"ff4f8606-b91c-4799-a8a7-1ddaffc0af7d","year":2020},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.676964Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:49e8cd9aeef509ead311bfee9ed0452a9ef2d8c1df3943937b3bd1a70b834872","observation_id":"fde614d8-e947-4889-ba77-774e0b1adc48","resolution":{"observed_at":"2026-08-15T14:54:46.149259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.126001Z","title":"Dc3: A learning method for optimization with hard constraints,","venue":null,"work_id":"a27c2a25-0b6e-4cc0-b564-36771871855f","year":2020},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.683411Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:46c40a2a9f662bbad619267315589b8715b90462a9de917c00bb935fbce1ee09","observation_id":"1b8d7160-e3f9-46f3-b424-c17daf34199a","resolution":{"observed_at":"2026-08-15T14:54:46.131270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.107569Z","title":"Electric vehicle charging management based on deep reinforcement learning,","venue":null,"work_id":"431dbc37-12a9-4057-a323-22c29efd7440","year":2021},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.689252Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:71caf85b3411d090bc09e32f80622a0c9f5607d3042649d4242d24e09089cd61","observation_id":"a7fece29-1d1a-4c24-a6d2-6e4aa6af8efa","resolution":{"observed_at":"2026-08-15T14:54:46.113630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.09772","last_updated":"2022-09-20T14:56:51Z","snapshot_observed_at":"2026-08-13T14:23:06.495199Z","submitted_at":"2022-09-20T14:56:51Z","title":"A Deep Reinforcement Learning-Based Charging Scheduling Approach with Augmented Lagrangian for Electric Vehicle","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.09772","snapshot_observed_at":"2026-08-15T14:54:45.695265Z","title":"A deep reinforcement learning-based charging schedul- ing approach with augmented lagrangian for electric vehicle,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.695265Z"},"links":{"cited_paper":"/paper/2209.09772","citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:3cd465a0ccfc64aef246b946cfdad741c1819b87a21d0820ecc3efae775ebb8a","observation_id":"973562ae-c36e-45a9-abb8-e747f2898cda","resolution":{"observed_at":"2026-08-15T14:54:45.695265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.089962Z","title":"Constrained ev charging scheduling based on safe deep reinforcement learning,","venue":null,"work_id":"0818013d-7bfc-4f02-850f-5692776b9659","year":2019},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.703561Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:e0b53f40c5797edcfb1505d26a88667eaba56394b1647caee8bf3f22cf742d34","observation_id":"f4a645fd-4f46-4717-b84c-d3b223d64939","resolution":{"observed_at":"2026-08-15T14:54:46.095483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.069201Z","title":"Network-constrained reinforcement learning for optimal ev charging control,","venue":null,"work_id":"d0b99c16-3c89-4e82-866b-075d5e256c11","year":2023},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.710557Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:3021716caedc428a4d69bb06b5ff0fd4be8bab3967012fbf36e29dbfda677ad3","observation_id":"72d089c4-c074-4016-9a59-4e909aba2d5c","resolution":{"observed_at":"2026-08-15T14:54:46.076196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2412.18047","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:45.902895Z","title":"Uncertainty-aware critic augmentation for hierarchical multi-agent ev charging control,","venue":null,"work_id":"8d6697fc-f592-422f-b3c6-42e6342c15de","year":2024},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.716234Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:2bc458118007e4130913bf4011db0841e76489b082bbad7bf67010efafa82528","observation_id":"884a572b-8ee3-4f5e-8869-9cb224c42bf7","resolution":{"observed_at":"2026-08-15T14:54:45.914786Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.050650Z","title":"Ev charging command fast allocation approach based on deep reinforcement learning with safety modules,","venue":null,"work_id":"98484b32-023a-4697-84ee-269f9aba242d","year":2023},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.722888Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:6f0dcc2ba2205e6591c74908c54d0adf6807885824f7bdc68dfac8c46f977240","observation_id":"b48e1ac6-5bd1-4e67-bbfa-a502000e5c68","resolution":{"observed_at":"2026-08-15T14:54:46.057040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.033584Z","title":"Distributionally robust optimiza- tion for vehicle-to-grid with uncertain renewable energy,","venue":null,"work_id":"8cb8b89b-1790-4d5c-a9f5-7c031402bf20","year":2022},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.728421Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:4c05863708fed3cd99d5a274ccd21ad8bce1013e0b35fc7ef9a1208b293c2736","observation_id":"4614ef42-b78e-4e3c-9ddb-fc4660c51bdb","resolution":{"observed_at":"2026-08-15T14:54:46.039398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:46.015961Z","title":"Reduced policy optimization for contin- uous control with hard constraints,","venue":null,"work_id":"b9881d0c-b58b-4307-a7d3-d1d4733101c6","year":2023},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.735245Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:d85577add9d196bf9a3074cfd479dd45aab6d9569601d341a45ce6bbf33c78a0","observation_id":"10dec163-3b76-4d10-9c12-eede7f47dda7","resolution":{"observed_at":"2026-08-15T14:54:46.021151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:45.998688Z","title":"Constrained large-scale real-time ev scheduling based on recurrent deep reinforcement learning,","venue":null,"work_id":"815b95a7-8e95-4d13-bd83-27d782bf4332","year":2023},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.741659Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:e87bf4ff86fa5362dd2780b4aa010179aa8a880ee66402ea225865df7df00df0","observation_id":"ccb80cd5-550b-401d-a5a9-a8a40397b2d2","resolution":{"observed_at":"2026-08-15T14:54:46.005171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14045","last_updated":"2025-06-16T22:36:32Z","snapshot_observed_at":"2026-08-15T19:53:02.408669Z","submitted_at":"2025-06-16T22:36:32Z","title":"Discovering Temporal Structure: An Overview of Hierarchical Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.14045","snapshot_observed_at":"2026-08-15T14:54:45.747996Z","title":"Discovering temporal structure: An overview of hierarchical reinforcement learn- ing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.747996Z"},"links":{"cited_paper":"/paper/2506.14045","citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:2fbe90d95f2cad4fd0150f7c7554d10cc2580f6eac0294123bae04ffd5fc9c6b","observation_id":"04b876a1-4f95-45e0-b384-cf8a860fab91","resolution":{"observed_at":"2026-08-15T14:54:45.747996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:45.977364Z","title":"Constrained policy optimization,","venue":null,"work_id":"c643055a-a120-405c-95b1-87e788667f88","year":2017},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.753535Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:31d5f0f3e84c79380fe7f5334cf6fb8c0890a5978faa74bfe355a9763970d0f5","observation_id":"24d43121-4e65-40aa-9d94-a06ec92bc749","resolution":{"observed_at":"2026-08-15T14:54:45.982343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07565","last_updated":"2022-02-15T16:49:28Z","snapshot_observed_at":"2026-08-13T16:40:18.196145Z","submitted_at":"2022-02-15T16:49:28Z","title":"CUP: A Conservative Update Policy Algorithm for Safe Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07565","snapshot_observed_at":"2026-08-15T14:54:45.758379Z","title":"Cup: A conservative update policy algorithm for safe reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.758379Z"},"links":{"cited_paper":"/paper/2202.07565","citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:20df1f216ff6b02664cd54e9aea2a0062b75073458b7d35b88f5382dfc61b992","observation_id":"b972b589-e656-446d-807d-5067f6c8cf55","resolution":{"observed_at":"2026-08-15T14:54:45.758379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:45.960996Z","title":"De- terministic policy gradient algorithms,","venue":null,"work_id":"3a41efe1-e358-4995-99d8-602b5b0af420","year":2014},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.763835Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:2f6c4b50094f99224f5214a54ee5db73cbe2411a8e64b2f76d843a4f9ca5b80e","observation_id":"df440459-b6e9-44eb-a47c-ebb5410c7478","resolution":{"observed_at":"2026-08-15T14:54:45.965997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:54:45.944782Z","title":"Soft actor-critic: Off-policy maxi- mum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":"76e14da3-c093-4379-9209-d7f65a2b4503","year":2018},"citing_paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:45.769653Z"},"links":{"citing_paper":"/paper/2608.03409"},"observation_digest":"sha256:3aac6608dbd9d55e1a1ecf8d18d50d6e14da75e2a7aafcaa8fdaf07c3944fd36","observation_id":"e5168db4-dc17-4082-821f-398f2ef875e6","resolution":{"observed_at":"2026-08-15T14:54:45.950473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03409","last_updated":"2026-08-04T10:04:08Z","latest_version":1,"primary_category":"cs.CE","snapshot_observed_at":"2026-08-15T14:47:59.081517Z","submitted_at":"2026-08-04T10:04:08Z","title":"Hierarchical Constrained Reinforcement Learning with Dynamic Boundary for Spatio-Temporal Vehicle-to-Grid Scheduling"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":1,"verified_fuzzy":30},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2608.03409."}