{"as_of":"2026-08-19T05:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:61ffb1051ec3b38c265c9b83d1da2113566ee74d1a784ab1c6203dc9ab2c725f","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T18:56:21.470013Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:44:36.631711Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-10T05:30:23.456663Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-10T05:30:23.456663Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"cited_work":{"arxiv_id":"2411.11180","doi":"10.48550/arxiv.2411.11180","metadata_source":"pith","pith_arxiv_id":"2411.11180","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","venue":"eess.SY","work_id":"75b25c82-3e9c-4137-ab49-ec2852b2ff82","year":2024},"citing_paper":{"arxiv_id":"2508.19541","last_updated":"2025-08-27T03:28:36Z","snapshot_observed_at":"2026-08-18T14:06:50.765944Z","submitted_at":"2025-08-27T03:28:36Z","title":"Hybrid ML-RL Approach for Smart Grid Stability Prediction and Optimized Control Strategy","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T15:44:36.631711Z"},"links":{"cited_paper":"/paper/2411.11180","citing_paper":"/paper/2508.19541"},"observation_digest":"sha256:8bca8472206e71d2298b0da6abf4fb8e733a05694e1f70929d5fc3cfd3cf0d12","observation_id":"8de69fbe-f8f1-457b-a3c6-42e66ec9d0f4","resolution":{"observed_at":"2026-08-05T15:44:37.817072Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.11180/citation-record","integrity":"/paper/2411.11180/integrity","json":"/paper/2411.11180/citation-record.json","paper":"/paper/2411.11180"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.925076Z","title":"General nonlinear modal representation of large scale power systems,","venue":null,"work_id":"a01a9049-9cb6-47c2-944d-34e519a297a5","year":2003},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.362667Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:6c73a9588d2bf4e6b22c8e03459fc5eb882003a44890316dce81625caaa2f61b","observation_id":"5d034281-218e-4f20-8fd2-a8445b0a4c8f","resolution":{"observed_at":"2026-08-12T18:56:21.929539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.912850Z","title":"Efficient and scalable reinforcement learning for large-scale network control,","venue":null,"work_id":"d8650f7e-8db1-4c6e-9e41-b9604ec59698","year":2024},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.367368Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:3d082dff32aa4487c2e799036e157417166ebce67e503ea6fb7ac201e9d68fd2","observation_id":"911d5e59-24e6-4e98-8348-f1e15b66dda7","resolution":{"observed_at":"2026-08-12T18:56:21.916828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.901052Z","title":"Deep reinforcement learning for real-time power grid topology optimization,","venue":null,"work_id":"c3066eac-1a3f-4bec-85d5-9a0b8e8f31e6","year":2021},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.371650Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:493ee7505e3ff380c67a5ff3e0bf4030accf1a4c08e92023a3c0b3e166d2107d","observation_id":"a01b41c7-96d6-428d-8b51-2eb7aeafef92","resolution":{"observed_at":"2026-08-12T18:56:21.905242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.889014Z","title":"Study on the structural complexity of large scale power grids,","venue":null,"work_id":"de2eaf70-8622-445e-87d6-15854e9c25cb","year":2013},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.376228Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:4ea4f26254682d348401460933790ca21ed746762bd0674d5638799331516a54","observation_id":"1d20d713-3a0b-4474-9866-9d49df626b76","resolution":{"observed_at":"2026-08-12T18:56:21.893119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.876045Z","title":"A deep reinforcement learning framework for automatic operation control of power system considering extreme weather events,","venue":null,"work_id":"58720fbd-c88e-41da-9337-d0467c2c77e6","year":2022},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.380744Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:7019104bf268145475507811cf2634bf7372a454a0343e95a786f5793a4eed3d","observation_id":"7cb673ba-343c-44b1-a6ab-c512f4a2d609","resolution":{"observed_at":"2026-08-12T18:56:21.880417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.862399Z","title":"Smart grid vulnerability and defense analysis under cascading failure attacks,","venue":null,"work_id":"04d5f1fb-7109-4e58-90c6-95e10e31f0dd","year":2021},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.385610Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:e467335426914a497f7cf263fb20e0c6a068377637e88bbbcb855148c655fe6d","observation_id":"cf633952-cd31-4fa4-9a5a-f13d71e9c862","resolution":{"observed_at":"2026-08-12T18:56:21.867361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03104","last_updated":"2021-10-21T17:02:53Z","snapshot_observed_at":"2026-08-16T18:41:55.491694Z","submitted_at":"2021-03-02T09:52:24Z","title":"Learning to run a Power Network Challenge: a Retrospective Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03104","snapshot_observed_at":"2026-08-12T18:56:21.390206Z","title":"Learning to run a power network challenge: a retrospective analysis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.390206Z"},"links":{"cited_paper":"/paper/2103.03104","citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:61c2a7ee9f78435856656400908e29e53aae6b8a3510d3440542a7192740be28","observation_id":"879fc3a0-51cb-4990-b319-8f7a69ff20ea","resolution":{"observed_at":"2026-08-12T18:56:21.390206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.849982Z","title":"Reinforcement learning agents,","venue":null,"work_id":"924fd800-8d0b-48fb-a718-a29105f60586","year":2002},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.395129Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:94747b04cd6846c9ee03c11a0fe490b3633956f13a5fa734c26a5c57f7ca6b3e","observation_id":"4b487e9c-acd8-4219-ad6d-357f2c780420","resolution":{"observed_at":"2026-08-12T18:56:21.854227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.837653Z","title":"Intelligent hur- ricane resilience enhancement of power distribution systems via deep reinforcement learning,","venue":null,"work_id":"d475b509-f14d-4c4a-a3b4-9790bff7787d","year":2021},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.399048Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:37b26c8156d86de06edf15cf7f4c6948b91769d83fba6967d77d0d40d3f2a588","observation_id":"077729ad-f221-4e0d-80f4-a1eb5c669681","resolution":{"observed_at":"2026-08-12T18:56:21.842205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.825023Z","title":"Curriculum based reinforcement learning of grid topology controllers to prevent thermal cascading,","venue":null,"work_id":"865b80a3-9e05-4e3e-b70a-5d6b109a44e5","year":2023},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.403232Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:66448aa077ab9c66de29e0dad232419af02921e0233646d605c3e4e665ee9ba5","observation_id":"459578ca-d5dd-4c97-9ace-8ff0f64e1107","resolution":{"observed_at":"2026-08-12T18:56:21.829396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.806442Z","title":"Curriculum-based reinforcement learning for distribu- tion system critical load restoration,","venue":null,"work_id":"5ed4829e-d1b0-4336-8192-892ee53e51b2","year":2023},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.407163Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:41f8e36870a2fbe141e8eaf5e316c3a14ee58aa308fc4226a0ae80a44a622600","observation_id":"64310cc6-e338-4eea-aa71-6b8fee87a07f","resolution":{"observed_at":"2026-08-12T18:56:21.816393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.783651Z","title":"Resilience enhancement of multi- agent reinforcement learning-based demand response against adversarial attacks,","venue":null,"work_id":"1026681e-db10-4dc3-ab9d-4ccc15b4b10e","year":2022},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.410671Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:1f9a8dcf5b13952840a0b8dc5791f2681a5ed23f31b1f02b7bf2dec4315f9f3a","observation_id":"8861dc8a-05c4-4942-90e1-a6101e1e8229","resolution":{"observed_at":"2026-08-12T18:56:21.788909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.771321Z","title":"PowerGridworld: A framework for multi-agent reinforcement learning in power systems,","venue":null,"work_id":"820736a7-605f-4524-a1f7-ddd1f4ab75f3","year":2022},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.415063Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:10fd7b8048ad2197da49f81c36a48860cd6a5b84dbc4c09edff3206bc8e16ef5","observation_id":"b340b1aa-2041-454a-9316-6aa78c448b3c","resolution":{"observed_at":"2026-08-12T18:56:21.775605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.757460Z","title":"Managing power grids through topology actions: A comparative study between advanced rule-based and reinforcement learning agents,","venue":null,"work_id":"012b59e1-678f-4ad5-ab77-b767c289e4a1","year":2023},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.419072Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:b280206b5f86a892697573aade9a9419701c70611b4982cf91910494f63bfbb8","observation_id":"01e9ab9b-6774-4d82-a17b-50d061d44912","resolution":{"observed_at":"2026-08-12T18:56:21.762340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.744999Z","title":"A new framework integrating reinforcement learning, a rule-based expert system, and decision tree analysis to improve building energy flexibility,","venue":null,"work_id":"06f124f6-5a7a-4a92-a67b-0dabc04a91e9","year":2023},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.422800Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:b2d4947a0996ec0d4feb623c803f379112bbd88da0cd846bbf332a53b94023e2","observation_id":"dec25a55-f929-40c1-860e-6d3fcde17fc3","resolution":{"observed_at":"2026-08-12T18:56:21.749134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.732030Z","title":"Grid2Op—A testbed platform to model sequential decision making in power systems,","venue":null,"work_id":"7987ed67-f153-4c64-93ae-c83d186e6261","year":2020},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.426800Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:2c7cffb1fa143c9b65506724d399ba5dbfde05e72c4a32873115864434bb7f64","observation_id":"ad6dcd61-ba13-48d1-8e29-c4cd9c7a9be9","resolution":{"observed_at":"2026-08-12T18:56:21.736900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.719171Z","title":"A Markov decision process to enhance power system operation resilience during hurricanes,","venue":null,"work_id":"c4d58f98-56b7-4737-af31-4373a1d7ebe4","year":2021},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.430541Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:60362dab6fb40976ff08dd4824948e50712d231c98a4c060db8fef238170d926","observation_id":"d2543ad4-67e2-4a23-b5b2-cf6b68520628","resolution":{"observed_at":"2026-08-12T18:56:21.723538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.704733Z","title":"Dynamic power management based on continuous-time Markov decision processes,","venue":null,"work_id":"84df72b7-15f1-444d-ab18-dda409b06db3","year":1999},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.434244Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:211f3e161875e96526c58c7eddb6b339811a4c237796b6d4692331c008357836","observation_id":"60ee8d32-a66e-4c7d-a1f5-694411a7d90e","resolution":{"observed_at":"2026-08-12T18:56:21.709863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.691280Z","title":"Heterogeneous reinforcement learning for defending power grids against attacks,","venue":null,"work_id":"36abb1c2-0237-412c-ac49-9582573f4568","year":2024},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.437981Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:13fb1353c5177be79ec6688b00150d88415ffe2b3e8a94bce1b4bb3eb917b4f9","observation_id":"33097a2b-fcca-46e8-bc4a-c2dfcab38f0d","resolution":{"observed_at":"2026-08-12T18:56:21.695607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.679039Z","title":"Pandapower—An open-source Python tool for con- venient modeling, analysis, and optimization of electric power systems,","venue":null,"work_id":"53c7dc90-0541-480e-931d-e9802a106ee3","year":2018},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.441609Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:f89ac68a3edfbfd43aa0a32dde8d425a7e64872414d0f56523ae27be1d1eb406","observation_id":"5da69116-f0ec-40fc-abda-da001f6973d7","resolution":{"observed_at":"2026-08-12T18:56:21.683331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-12T18:56:21.445206Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.445206Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:b32bcd528f3576727a4d3c99af5c5cb9244dd698f4d7afdb7f6dd0975eb395e8","observation_id":"bdbde768-d059-4b21-8b45-af64d4bffe84","resolution":{"observed_at":"2026-08-12T18:56:21.445206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1502.05477","last_updated":"2017-04-20T18:04:12Z","snapshot_observed_at":"2026-08-15T12:05:11.299477Z","submitted_at":"2015-02-19T06:44:25Z","title":"Trust Region Policy Optimization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.05477","snapshot_observed_at":"2026-08-12T18:56:21.449908Z","title":"Trust region policy optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.449908Z"},"links":{"cited_paper":"/paper/1502.05477","citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:73e8d49c8dec06aaaaaa3234d8d722f300500b5f05c6ff9b5a4a9d8220ef293a","observation_id":"fd624ecd-7d6d-44b8-9033-c05bfa527006","resolution":{"observed_at":"2026-08-12T18:56:21.449908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.666117Z","title":"Stable-Baselines3: Reliable reinforcement learning implementations,","venue":null,"work_id":"abbaf278-86a9-4a08-98a6-fefe0983b2b0","year":2021},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.454053Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:712550237e6019895391596bbc1345581c29560af30eb73b1ac8c8a1c031b43b","observation_id":"bbbc7ba5-23a8-4110-8add-993e49083fc7","resolution":{"observed_at":"2026-08-12T18:56:21.670327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-08-13T22:24:37.672685Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-12T18:56:21.457890Z","title":"Gymnasium: A standard interface for reinforcement learning environments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.457890Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:d0654f7725a117074daaea034de2980f88c423c158fa12a4eb28b742ae342c0f","observation_id":"424182d8-652c-4ae3-a4ca-28886d7207e9","resolution":{"observed_at":"2026-08-12T18:56:21.457890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.653744Z","title":"Topological graph convolutional networks solutions for power distribution grid planning,","venue":null,"work_id":"10e08ce9-a5b9-415d-ab3d-29fdd276c5c2","year":2023},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.462320Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:e89164c2fab383546e53fd50311627f94b7372e32b8b86f1defacb4ab241fe3d","observation_id":"42c32616-a1ba-4bde-b843-86ac43eb3934","resolution":{"observed_at":"2026-08-12T18:56:21.657876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.466403Z","title":"Proximal policy optimization with graph neural networks for optimal power flow,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.466403Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:759cb376eca848293f8f9a0dc588c27dfc4dc875209b223239abb026bd39322f","observation_id":"f43420cb-7752-44d1-a46a-5218bb48138f","resolution":{"observed_at":"2026-08-12T18:56:21.466403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.638276Z","title":"Fast graph representation learning with PyTorch Geometric,","venue":null,"work_id":"45fb6483-4776-43a9-91f9-df9b61cc5c02","year":2019},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.470013Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:460d53749fcd3848461f03963d71b750a3b553a21022d60934a429e5c025a9dd","observation_id":"5ed7f0cf-5df3-4b17-b2fd-6c1d6f3c86de","resolution":{"observed_at":"2026-08-12T18:56:21.644824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","latest_version":1,"primary_category":"eess.SY","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 1 inbound Pith citation observation for arXiv:2411.11180."}