{"as_of":"2026-08-19T11:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e935443fae371335df70adeb796892f26217c1248a58d6506bfce02e932c9c3b","coverage":[{"denominator":220,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:40:31.954544Z","state":"measured"},{"denominator":103,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":103,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:19:19.132931Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T13:54:51.342682Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01007","snapshot_observed_at":"2026-08-07T12:12:54.613148Z","title":"Deep reinforcement learning for job scheduling and resource management in cloud computing: An algorithm-level review","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00260","last_updated":"2025-05-30T21:50:28Z","snapshot_observed_at":"2026-08-18T22:00:46.432154Z","submitted_at":"2025-05-30T21:50:28Z","title":"GrapheonRL: A Graph Neural Network and Reinforcement Learning Framework for Constraint and Data-Aware Workflow Mapping and Scheduling in Heterogeneous HPC Systems","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:54.613148Z"},"links":{"cited_paper":"/paper/2501.01007","citing_paper":"/paper/2506.00260"},"observation_digest":"sha256:afc497ccace0d68fb140eb3f4b8d53f67b4834abf11346d639fa86c886723fad","observation_id":"32fc1909-30d3-4f4b-ad23-64b35c5f8ac6","resolution":{"observed_at":"2026-08-07T12:12:54.613148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01007","snapshot_observed_at":"2026-08-15T17:19:19.132931Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12857","last_updated":"2025-08-18T11:53:38Z","snapshot_observed_at":"2026-08-18T03:21:49.712816Z","submitted_at":"2025-08-18T11:53:38Z","title":"REACH: Reinforcement Learning for Efficient Allocation in Community and Heterogeneous Networks","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T17:19:19.132931Z"},"links":{"cited_paper":"/paper/2501.01007","citing_paper":"/paper/2508.12857"},"observation_digest":"sha256:5c6543818a40b8a974e3849e1efda7b5c3d7fc3318fb45fa3145c2ce674322a9","observation_id":"eae6241b-d18a-4860-a34b-2a382e4a5ce4","resolution":{"observed_at":"2026-08-15T17:19:19.132931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"cited_work":{"arxiv_id":"2501.01007","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.01007","snapshot_observed_at":"2026-08-05T13:54:51.342682Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","venue":"cs.DC","work_id":"39104042-40d9-443d-805c-faa0ade66b42","year":2025},"citing_paper":{"arxiv_id":"2509.00280","last_updated":"2025-08-29T23:45:09Z","snapshot_observed_at":"2026-08-15T03:39:24.557380Z","submitted_at":"2025-08-29T23:45:09Z","title":"ReLATE: Learning Efficient Sparse Encoding for High-Performance Tensor Decomposition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.153111Z"},"links":{"cited_paper":"/paper/2501.01007","citing_paper":"/paper/2509.00280"},"observation_digest":"sha256:16b258e21226c6802e3d4c08787439fea76b20728dc2598351dee84264c314ab","observation_id":"e7569856-ec6d-40ef-b1a8-53322aaad270","resolution":{"observed_at":"2026-08-05T13:54:51.422030Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.01007/citation-record","integrity":"/paper/2501.01007/integrity","json":"/paper/2501.01007/citation-record.json","paper":"/paper/2501.01007"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.606692Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.606692Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:9a5e93495e774b50178fe6db05525bb371751ac9a1bf96ecd4f318365119b65b","observation_id":"54f1f23f-2307-4622-8196-d24018e8d8a3","resolution":{"observed_at":"2026-08-10T22:40:31.606692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.611160Z","title":"Scalable discovery of hybrid process models in a cloud computing environment,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.611160Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:4e655b3e3420bb378b8994a5a9530ef7852bb6f703140ab0a5c0a821fdd6c9b1","observation_id":"b12cfa77-dc18-4ee6-94c9-c71598ebb36e","resolution":{"observed_at":"2026-08-10T22:40:31.611160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.615098Z","title":"Differentiate quality of experience scheduling for deep learning in- ferences with docker containers in the cloud,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.615098Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:ec16ec84d3aa0eb953ce67754a224c1fb059aabcd8a903492387db0f5b6eac15","observation_id":"9b3164fc-a741-45f5-8d0a-e403b4460e89","resolution":{"observed_at":"2026-08-10T22:40:31.615098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.618711Z","title":"Distributed artificial intelligence empowered by end-edge-cloud com- puting: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.618711Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:1e0e3bde94b91881d4fd937f08b50761e374ce9d97899a8f301e3ffc78d1562a","observation_id":"d6f4b881-bfaf-43a6-a21e-e58cce6705dd","resolution":{"observed_at":"2026-08-10T22:40:31.618711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.622490Z","title":"Resource scheduling in edge computing: A survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.622490Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:7fe22b55d65e7d705d321e42966bbe3401d4e9869644cd40a59e3184fa57e87e","observation_id":"6143caf6-61d4-4b58-afe1-9a1372b93aed","resolution":{"observed_at":"2026-08-10T22:40:31.622490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.626059Z","title":"A2c-drl: Dynamic scheduling for stochastic edge-cloud environments using a2c and deep reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.626059Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:b630e264adc40c528a636f2f7ce520bf34569bf5b1de385f134bad8a7139e914","observation_id":"5396c0a2-8cca-44b2-9e41-f0a00de0319c","resolution":{"observed_at":"2026-08-10T22:40:31.626059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.630001Z","title":"Cost-aware job scheduling for cloud instances using deep reinforce- ment learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.630001Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:e119f501550ca06d4c20e09470bcff1f8371c1f2518edf2db24f745ff32012bb","observation_id":"f5a1deba-ee4b-45a1-b40a-871e0bedae61","resolution":{"observed_at":"2026-08-10T22:40:31.630001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.633415Z","title":"Dynamic On-Demand Ma- chine Provisioning and Continuous Resource Management,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.633415Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:b19e59870064ab943f41097ea7009b2784e61b279ce93e6589bb70ac78a12d82","observation_id":"4bb0223d-d010-4954-acb1-d5a4a8208f01","resolution":{"observed_at":"2026-08-10T22:40:31.633415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.636859Z","title":"Real-time dynamic pricing for revenue manage- ment with reusable resources, advance reservation, and deterministic service time requirements,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.636859Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:0cc5e0fc335668eac7962849392eb3da5b954a51b0c34d25c3e9fa9977654d88","observation_id":"1ef61b12-6e10-405f-b1a8-be502a6de6b2","resolution":{"observed_at":"2026-08-10T22:40:31.636859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.640529Z","title":"Resource Allocation for Genera- tive AI Workloads: Advanced Cloud Resource Management Strategies for Optimized Model Performance,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.640529Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:e771dba3ca52f9a4c41aa87da7f41d28787bb117c50a69e544e72c672c9377d4","observation_id":"d41ad0b1-1765-499b-b848-6016950034d0","resolution":{"observed_at":"2026-08-10T22:40:31.640529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.644052Z","title":"Energy-aware systems for real-time job scheduling in cloud data centers: A deep reinforcement learning approach,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.644052Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:7a958fd059d94a842df09f477e52cdf91825ee2a4813e9417409e160e925457a","observation_id":"3a5cc217-b464-40c3-b109-771c7a0b32c2","resolution":{"observed_at":"2026-08-10T22:40:31.644052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.647561Z","title":"A low-cost multi-failure resilient replication scheme for high-data availability in cloud storage,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.647561Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:fab449889cb6680346aaa24b2eab802a87ab67d6791bed7a033939a14e15848d","observation_id":"c22576c4-3b73-4b1b-bb12-85bba06c16e8","resolution":{"observed_at":"2026-08-10T22:40:31.647561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.650858Z","title":"Recent advances of resource allocation in network function virtualization,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.650858Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:75bc9eda17e23d681217b82f827a4ccc0541209ebc1fbb1afe52147f49288f7c","observation_id":"e8397a8a-18bc-4ea1-9568-5a07550d3575","resolution":{"observed_at":"2026-08-10T22:40:31.650858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.653839Z","title":"A survey on resource allocation for 5G heterogeneous networks: Current research, future trends, and challenges,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.653839Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:228ffe738fcf86e28c969d3a42fe0db47a49553d4cd8ae92661ee596273b223e","observation_id":"26b9b1b5-b66d-476c-b9d2-ce5d87e67fa4","resolution":{"observed_at":"2026-08-10T22:40:31.653839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.657236Z","title":"Task scheduling in cloud computing based on meta-heuristics: review, tax- onomy, open challenges, and future trends,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.657236Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:5a37628f2089a384b0b272567df6b6f3c2d0e482a15e197b4070b2ef838771d9","observation_id":"b0fae3d9-aa40-4551-8eeb-5ad5de1b0ddf","resolution":{"observed_at":"2026-08-10T22:40:31.657236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.660630Z","title":"A survey on PSO based meta- heuristic scheduling mechanism in cloud computing environment,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.660630Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:df6fdfdab6d8be8e3f8f83aa027ebea2c035f08c011f068d6fd9d44878f90aec","observation_id":"4d43445a-898a-4f2f-bbe3-55d0f225b367","resolution":{"observed_at":"2026-08-10T22:40:31.660630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.663958Z","title":"Resource management and scheduling in distributed stream processing systems: a taxonomy, review, and future directions,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.663958Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:f6e8ec6acbd9f3d306792fc29efab4a15d0700318dafe28bd958dc3e7bb8a451","observation_id":"ddd9611e-f0e5-4891-b0c2-1232f16b6796","resolution":{"observed_at":"2026-08-10T22:40:31.663958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.667274Z","title":"Resource allocation and task scheduling in fog computing and internet of everything environments: A taxonomy, review, and future directions,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.667274Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:c21a59c1fd53b82d65a7594726e8125d461a9006cd48bfd45691c56b3f0fd97e","observation_id":"d8163727-384b-4150-94d2-d499023b478a","resolution":{"observed_at":"2026-08-10T22:40:31.667274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.670668Z","title":"Resource allocation and service provisioning in multi-agent cloud robotics: A comprehensive survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.670668Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:a6644660751e2dc218d547f590cb884a0a95c772eab978fea424a3004206a4cb","observation_id":"249b074d-563d-44b5-bc4f-3742995f9a99","resolution":{"observed_at":"2026-08-10T22:40:31.670668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.674059Z","title":"Deep reinforcement learning-based methods for resource scheduling in cloud computing: A review and future directions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.674059Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:9720eddfc4d0e29ad38859d80a3218c60d7f8020f435de047a593fbe4be0cc1a","observation_id":"7ee559d3-49d6-4ee8-a401-8a8009464de1","resolution":{"observed_at":"2026-08-10T22:40:31.674059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.677161Z","title":"Deep rein- forcement learning-based scheduling in distributed systems: a critical review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.677161Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:031a0611811dc574e79943513f7c5ef66842d6696f7d71e190ec22829f392623","observation_id":"44e164cd-2ecb-49e4-b973-8edd5dfd0dde","resolution":{"observed_at":"2026-08-10T22:40:31.677161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.680424Z","title":"Comparative study of scheduling al-gorithms in cloud computing environment,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.680424Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:9cefc3531bbb2dd39d5875e0c1afef9d9a7a2474aef784258683ef3a58838a41","observation_id":"173a4baa-4539-4a7d-b0b6-25c38a6aa175","resolution":{"observed_at":"2026-08-10T22:40:31.680424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.683772Z","title":"User-priority guided Min-Min scheduling algorithm for load balancing in cloud computing,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.683772Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:8bee45920636181553bc3f7d44a3f5c72dbb86bb6fb5f380b654bf9a49568c2a","observation_id":"72be29f4-7d5a-4ecf-bd02-d4e662d2767c","resolution":{"observed_at":"2026-08-10T22:40:31.683772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.687287Z","title":"A heuristic- based task scheduling algorithm for scientific workflows in heteroge- neous cloud computing platforms,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.687287Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:f4145a04cbe76de14ed1694dc381a7f46552fdf3b40179cc8293fdd50b76f7d1","observation_id":"5aed7efc-d8db-4c22-a65f-443ba7919dc9","resolution":{"observed_at":"2026-08-10T22:40:31.687287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.690724Z","title":"PGA: a priority-aware genetic algorithm for task scheduling in heterogeneous fog-cloud computing,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.690724Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:0221b1626c29fcfd3941dea9b7ec547ef2ab32593d200231932e366f24058be8","observation_id":"f1d5e3ab-a1e1-4f1d-b822-7c0c194cbec7","resolution":{"observed_at":"2026-08-10T22:40:31.690724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.694303Z","title":"A WOA-based optimization approach for task scheduling in cloud computing systems,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.694303Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:7e915eaf33c8fc6fb6beba6e6f14050ac5b1087c4eb97e5d917379dceb62a695","observation_id":"8bfd3b0b-3cff-444c-84d6-14a5e7dbbe0b","resolution":{"observed_at":"2026-08-10T22:40:31.694303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.697394Z","title":"A Novel Distributed Fog-Based Networked Architecture to Preserve Energy in Fog Data Centers,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.697394Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:1010d9f2a942b1ca8bd844346cbb74b087a0e10776d16989ddb5f0fadf4ce5a2","observation_id":"7dacf689-97e4-4b42-a728-f91dcc34f47c","resolution":{"observed_at":"2026-08-10T22:40:31.697394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.700773Z","title":"Resource Allocation Strategy in Fog Computing Based on Priced Timed Petri Nets,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.700773Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:73ec05caff707e57017b5a32160fc3f38f3e593729a578d54c664cae8ab0bacc","observation_id":"55bf88e6-1ce7-4a83-aa8b-611950715246","resolution":{"observed_at":"2026-08-10T22:40:31.700773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.703935Z","title":"A Multi- Objective Task Scheduling Method for Fog Computing in Cyber- Physical-Social Services,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.703935Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:1251fe2998339d224087d6d35838ecfb1c3a6664b90ab5ef934584b0f3a0e14e","observation_id":"80bc90ea-454e-47b2-ba60-5e028abb6655","resolution":{"observed_at":"2026-08-10T22:40:31.703935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.707274Z","title":"Optimizing resource scheduling based on extended particle swarm optimization in fog computing envi- ronments,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.707274Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:cab41dfa662aaac4f9a8fd230f73ba027be05f1f3232afe2855eb3a7894897fd","observation_id":"99677b07-d249-4630-b157-aaed2214ead9","resolution":{"observed_at":"2026-08-10T22:40:31.707274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.710813Z","title":"A deep reinforcement learning-based preemptive approach for cost-aware cloud job scheduling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.710813Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:2ad6a1ce70cbe8c0467b1e660b4d0dd2760d98745cb6356f61f36617ccaeb826","observation_id":"c3fb5489-168c-47e4-ba86-b267955f192a","resolution":{"observed_at":"2026-08-10T22:40:31.710813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.714304Z","title":"Reinforcement learning: An introduction,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.714304Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:2a72f2b9a16cbfc7eedf3a06796bf9e1153621b794e16409167692240f0f883a","observation_id":"e5ec4b55-834b-4988-a7e4-a0cf7a3d550e","resolution":{"observed_at":"2026-08-10T22:40:31.714304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.07274","last_updated":"2018-11-26T04:56:31Z","snapshot_observed_at":"2026-08-15T10:58:31.329286Z","submitted_at":"2017-01-25T11:52:11Z","title":"Deep Reinforcement Learning: An Overview","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.07274","snapshot_observed_at":"2026-08-10T22:40:31.717671Z","title":"Deep reinforcement learning: An overview,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.717671Z"},"links":{"cited_paper":"/paper/1701.07274","citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:d6f3775b831047807b10d53bd184b135d58697f323172e1638468d7d9082f2d1","observation_id":"a06a58d6-ffc2-4dd3-ae01-e60d557c7433","resolution":{"observed_at":"2026-08-10T22:40:31.717671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.721934Z","title":"Exploration in deep reinforcement learning: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.721934Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:5da887d612c67f8bd8ce9a8638ab300a3d960800611cffbc362b369df159a058","observation_id":"a4eb1a9c-7267-4b90-bfb4-ef81cbb7350e","resolution":{"observed_at":"2026-08-10T22:40:31.721934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.725367Z","title":"Learning relation in crowd using gated graph convolutional networks for drl-based robot navigation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.725367Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:8cc3f10396f832317a7f4a6b1b5c3ce31b5078b9b19f6ebc206442aa0c034772","observation_id":"18579377-c0f3-45bf-8789-4d1954007313","resolution":{"observed_at":"2026-08-10T22:40:31.725367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.728748Z","title":"Marp: A cooperative multiagent drl system for connected autonomous vehicle platooning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.728748Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:5aea45c5e82cebbc17e1455e1b4cc21cf7d6481d40e7c4e84e3449b08f866216","observation_id":"52139a44-c738-4ae7-b647-4ecbe31ddf98","resolution":{"observed_at":"2026-08-10T22:40:31.728748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.732232Z","title":"Deep reinforcement learning for communication flow control in wireless mesh networks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.732232Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:fc62ae6a2d297aee82d0551d4b982da7d2ccf7a1e3c377fb88adf10caefdd311","observation_id":"51799f54-b6d2-4778-bafe-368f7158425f","resolution":{"observed_at":"2026-08-10T22:40:31.732232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.735686Z","title":"Deep reinforcement learning for load-balancing aware network control in iot edge systems,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.735686Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:69329b98e47dbab26d3fb6f61936f6b80a162c1debb8bfd781709d80ab739b68","observation_id":"190dd6f3-1b95-4cf1-8590-78fdef69a29b","resolution":{"observed_at":"2026-08-10T22:40:31.735686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.739163Z","title":"Taxonomies of workflow scheduling problem and techniques in the cloud,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.739163Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:edc2d834bedbf37fc5cd03bbd5a82f41335d1f3f25827f434be32977b7c48a64","observation_id":"a75d2e47-08c9-4529-8e27-1402fa673f48","resolution":{"observed_at":"2026-08-10T22:40:31.739163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.742632Z","title":"An integrated optimization method to task scheduling and vm placement for green datacenters,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.742632Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:3113c3939401c51541c11b0d7ef490ea959140194ae6578842676c7e6e9854ee","observation_id":"06e31c48-b51f-45c2-a5b8-2ebadd30a689","resolution":{"observed_at":"2026-08-10T22:40:31.742632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.746173Z","title":"Job scheduling in hybrid clouds with privacy constraints: A deep reinforcement learning approach,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.746173Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:7710c671cb37e147e24bfd3194cbd8ceebf8b8a3c238916e02cb0ce761d323d6","observation_id":"a811587d-4b8f-4cec-b384-2530ddb2fc61","resolution":{"observed_at":"2026-08-10T22:40:31.746173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.749953Z","title":"Security-driven heuristics and a fast genetic algorithm for trusted grid job scheduling,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.749953Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:7ff94de9ddcf36a37291c2683dd275c45c8e2b1c0c7ba9a1681aec562387c88c","observation_id":"f198dbb3-0b88-42c9-8b2d-3fb25886ad33","resolution":{"observed_at":"2026-08-10T22:40:31.749953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.753262Z","title":"Scheduling jobs across geo- distributed datacenters with max-min fairness,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.753262Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:36c532a6ff31008f04d6a52044ed02e5864b69d6c567814ad914faf5a32f6a50","observation_id":"4a04c62f-4a5b-4574-8ef0-6483602f7684","resolution":{"observed_at":"2026-08-10T22:40:31.753262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.756862Z","title":"Pricing schemes in cloud computing: an overview,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.756862Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:a5c26568b75aa17d0628ce5bd4e10ec428545df720f1abc1a3e9ddf466ddc6ec","observation_id":"aec549a8-1eb1-4c22-8d0e-259ea5bc951a","resolution":{"observed_at":"2026-08-10T22:40:31.756862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.760403Z","title":"Qos aware job scheduling in a cluster-based web server for multimedia applications,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.760403Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:27490e5cc28269347a8acbe53e02ecf4dc9be4704362c671bc0bfc0587e3a9bb","observation_id":"c7172c2d-058d-4dc6-886e-ab0f34518c4d","resolution":{"observed_at":"2026-08-10T22:40:31.760403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.763883Z","title":"Approximate data mapping in refresh-free dram for energy-efficient computing in modern mobile systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.763883Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:7b3288197618e4d3371e75949b8d63eec418984ae1b23ed5acc33d9001c82385","observation_id":"6ef43f90-568c-4489-873f-0455744ee5ee","resolution":{"observed_at":"2026-08-10T22:40:31.763883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.767445Z","title":"Energy-latency trade-off analysis for scientific workflow in cloud environments: the role of processor utilization ratio and mean grey wolf optimizer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.767445Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:86bc6c14d0d6f74805bc0a42da06fde9e82aaf7bf77e50d56ae5c891f0e6cbd7","observation_id":"de0724f9-4080-4b4b-8ea7-ee9cfd3b03bc","resolution":{"observed_at":"2026-08-10T22:40:31.767445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.770791Z","title":"A data and task co-scheduling algorithm for scientific cloud workflows,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.770791Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:3f8ba6165b0cc1a506ab4bf23fc07d61d374aa255f1c7f659529ef83f588618c","observation_id":"bf8f7cb8-be4b-49b7-8f46-e8e4d9ae4122","resolution":{"observed_at":"2026-08-10T22:40:31.770791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.774328Z","title":"Performance-effective and low-complexity task scheduling for heterogeneous computing,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.774328Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:690daa79b1cdc9769b421a58e6abd2871e5feeed38f0dc28aba25d7487e28e73","observation_id":"d9e4bdcd-947b-4df9-af5c-7cb52c77eabf","resolution":{"observed_at":"2026-08-10T22:40:31.774328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.777996Z","title":"Endpoint communication contention- aware cloud workflow scheduling,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.777996Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:1a446dab87fdfca0e2a495c35b64a013cfddb601decddbefd9c9ae935e629e0e","observation_id":"b0c27ce4-912b-4895-9e6a-b4481c2ccc84","resolution":{"observed_at":"2026-08-10T22:40:31.777996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11209","last_updated":"2023-08-22T05:45:58Z","snapshot_observed_at":"2026-08-18T21:20:27.946079Z","submitted_at":"2023-08-22T05:45:58Z","title":"A Deep Reinforcement Learning based Algorithm for Time and Cost Optimized Scaling of Serverless Applications","version":1},"cited_work":{"arxiv_id":"2308.11209","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.11209","snapshot_observed_at":"2026-08-10T22:40:32.523394Z","title":"A Deep Reinforcement Learning based Algorithm for Time and Cost Optimized Scaling of Serverless Applications","venue":"cs.DC","work_id":"8fbf98f8-461a-49fe-ac5d-0437e7ed1eba","year":2023},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.781252Z"},"links":{"cited_paper":"/paper/2308.11209","citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:680330454da6aced0df0d61b9c858486c537b00aff4d3b5ab41e123766583c12","observation_id":"7eece480-6eff-4413-beeb-2a477776c9ed","resolution":{"observed_at":"2026-08-10T22:40:32.527401Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.785076Z","title":"A Hierarchical Framework of Cloud Resource Allocation and Power Management Using Deep Reinforcement Learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.785076Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:d1caa1d27c7cd10dd707aab6efa0a4b15e7ca6b3653c8fb30b398d818d0ece40","observation_id":"97029463-fefb-4335-8a63-150255d8c5d7","resolution":{"observed_at":"2026-08-10T22:40:31.785076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.788370Z","title":"Deep reinforce- ment learning-based computation offloading and resource allocation in security-aware mobile edge computing,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.788370Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:90d3d92b3470566edc100f7ca8032ca4282aa9086bee69c3073090ffa8df7f55","observation_id":"41875071-622f-4aea-a221-83da7fcca156","resolution":{"observed_at":"2026-08-10T22:40:31.788370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.791793Z","title":"Computing resource allocation scheme of IOV using deep reinforcement learning in edge computing environment,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.791793Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:8c64320f828cf90f231112ab20357f4d794f79fd86ffde625007c3aa032c3ad0","observation_id":"51bc5acd-3e66-49d7-9080-92310c101bbd","resolution":{"observed_at":"2026-08-10T22:40:31.791793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.795166Z","title":"Multi-Agent Deep Rein- forcement Learning-Based Resource Allocation in HPC/AI Converged Cluster,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.795166Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:8f76fcc7ed2358ec86d6438bb2d09585c68bb8e78e99c3fdcba957648db7ea8c","observation_id":"a7299704-19da-4d9f-ba83-5c42cc0656af","resolution":{"observed_at":"2026-08-10T22:40:31.795166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.798662Z","title":"Multi-Agent Deep Reinforcement Learning-Based Partial Task Offloading and Resource Allocation in Edge Computing Environment,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.798662Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:4c69d6423349ef43c2fc90c55855ad3e9973acd8a74a534a1704b0cf2fb9488c","observation_id":"e441ba4a-8d30-49bd-831a-ad440960def3","resolution":{"observed_at":"2026-08-10T22:40:31.798662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.801932Z","title":"Rcsearcher: Reaction center identification in retrosynthesis via deep Q-learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.801932Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:29959e475134e06d7a14a8ee50af350c147e4591b0a33181568f079fc48dec00","observation_id":"765bc4dd-d320-42c4-908b-f29690f77e53","resolution":{"observed_at":"2026-08-10T22:40:31.801932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.805545Z","title":"Deep reinforcement learning for efficient iot data compression in smart railroad management,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.805545Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:e2394b8f39dda08c25cf37fd8e81beed66632d24a4d1e3ad25d2e7a6d97e8941","observation_id":"bc6e3c8a-6b47-462b-b1aa-d26b5769b2b0","resolution":{"observed_at":"2026-08-10T22:40:31.805545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.808939Z","title":"Policy learning with constraints in model-free reinforcement learning: A survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.808939Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:9dfd5975050b76a6991084866a78dba186c8ae1f7bb2ecdad757e8bb46d9aca2","observation_id":"a16be386-83f4-4b3b-af2e-f9be881c9e61","resolution":{"observed_at":"2026-08-10T22:40:31.808939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.812601Z","title":"Actor-critic algorithms,","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.812601Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:eb2c765b933facfd25ed4e877f3d7c1e5474bc63e72fd137d3eaaad8e69941b4","observation_id":"3023f350-5202-4cd0-973a-2a1584b2dd62","resolution":{"observed_at":"2026-08-10T22:40:31.812601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.816869Z","title":"Performance analysis of deep q networks and advantage actor critic algorithms in designing reinforcement learning-based self-tuning pid controllers,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.816869Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:49763b8f0457ea4a14ddc851261edd5e6fb12a7fff28887aa2e87589a1c04e88","observation_id":"26d9ab16-0642-439c-993d-dc901fb4ccd0","resolution":{"observed_at":"2026-08-10T22:40:31.816869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.820437Z","title":"Exact numerical simulation of the ornstein-uhlenbeck process and its integral,","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.820437Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:e787a9b46b4246d97a918400d1dc3e8b47a08ca143e7412ed6d94584ccf04ea2","observation_id":"96168bb8-40c0-4168-a354-a7470af61314","resolution":{"observed_at":"2026-08-10T22:40:31.820437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.824033Z","title":"Pantheonrl: A marl library for dynamic training interactions,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.824033Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:be90e35c53ef56ca182bf07fa4ec935763258e0c50844f1e06af483f526d95b5","observation_id":"4b270875-4aa5-447d-bf70-3aaed116fd10","resolution":{"observed_at":"2026-08-10T22:40:31.824033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.827615Z","title":"Imp-marl: a suite of environments for large-scale infrastructure management plan- ning via marl,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.827615Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:edfb1f4e5f8fe01d82d8458fdad4401f473c1129a47e480c8f14aaa6ff272f0a","observation_id":"f0e6a959-6498-44d7-b651-24e10002f3b2","resolution":{"observed_at":"2026-08-10T22:40:31.827615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.831102Z","title":"Multi-agent reinforcement learning as a rehearsal for decentralized planning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.831102Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:8216faeb0e3ef81a07f3365c697e3834891b34a2776b21e1a0540a457c077075","observation_id":"090d2b4a-6e03-41c5-ab08-50d38fd1eb20","resolution":{"observed_at":"2026-08-10T22:40:31.831102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.834622Z","title":"Multi- uav cooperative search based on reinforcement learning with a digital twin driven training framework,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.834622Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:11a39b9db3c4b40f54331b33e0c316424f0bd451a4e3b5b65d3a49d2ff5ea02b","observation_id":"43c761a7-5deb-490b-9912-517213a894d9","resolution":{"observed_at":"2026-08-10T22:40:31.834622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.838060Z","title":"Robust multi-agent reinforcement learning via minimax deep deterministic policy gradient,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.838060Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:0eb9de8d1b5d9d85ac5373e6d2964f63eb423d99d6f78434c6ad628e3ffd4ac9","observation_id":"6fd46377-50df-4d3a-894c-32b16a21a331","resolution":{"observed_at":"2026-08-10T22:40:31.838060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.841501Z","title":"Independent policy gradient methods for competitive reinforcement learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.841501Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:6f08f3b12beb3d6f26c0e24df5e8cb1f0a189eda8843d3390ba6077cee8b88f0","observation_id":"77891eb9-943a-439f-bd52-7386665edc17","resolution":{"observed_at":"2026-08-10T22:40:31.841501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.844812Z","title":"Distributed nash equilibrium seek- ing in games with partial decision information: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.844812Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:e82bc6f34dfee6e0c3a398b2191418cec66d0491e2fa2cf876cffcd91fafeb18","observation_id":"86c2b7df-d2ea-47ff-8f45-af42c31c1776","resolution":{"observed_at":"2026-08-10T22:40:31.844812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.848369Z","title":"’other-pla‘ for zero- shot coordination,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.848369Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:0da4e93f599f5a4440323508786ef5126cba2895e989a54a3070ebfeb811a7ff","observation_id":"a23c2251-380e-4f62-baf2-ba4eb60aaea4","resolution":{"observed_at":"2026-08-10T22:40:31.848369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.852032Z","title":"Model-based multi-agent rl in zero-sum markov games with near-optimal sample complexity,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.852032Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:355f041e4f886caee9a7987211bf1516572c0ba187fcbfe2dfe7a867940aad39","observation_id":"3fc1bddd-775c-4469-be64-1612b9fd7f16","resolution":{"observed_at":"2026-08-10T22:40:31.852032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.855790Z","title":"A td3-based multi-agent deep reinforce- ment learning method in mixed cooperation-competition environment,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.855790Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:299b83b7e51d8c142cd7569057e61973d7aba366bf23425f3ce9d4f8c34027c1","observation_id":"5d4ba2e1-b944-488d-b4ea-f5bbafda9887","resolution":{"observed_at":"2026-08-10T22:40:31.855790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.859429Z","title":"Phase transitions in random circuit sampling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.859429Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:e0c4a553cf2c08e61207c52b685dba99813946466b520c60f4f960134766ee42","observation_id":"16aa2c81-521c-4c45-99d5-5a676183d45f","resolution":{"observed_at":"2026-08-10T22:40:31.859429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.863171Z","title":"Demonstration of logical qubits and repeated error correction with better-than-physical error rates,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.863171Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:4ec49ccaec7b6911c8f6a890378baa625a7b9026af3a3d59d98fa65da3a8dc88","observation_id":"b6d26022-bd32-4fb1-8bb0-2b712ba689e4","resolution":{"observed_at":"2026-08-10T22:40:31.863171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.866651Z","title":"Drlbtsa: Deep reinforcement learning based task-scheduling algorithm in cloud computing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.866651Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:bbec30378613ae2740025fb9bd80b33895cbe3df282878365595738373ca22ed","observation_id":"87fc0d54-06c5-416c-ae87-3f0b0f03c399","resolution":{"observed_at":"2026-08-10T22:40:31.866651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.870023Z","title":"Drl-cloud: Deep reinforcement learning-based resource provisioning and task scheduling for cloud ser- vice providers,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.870023Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:83ce19ba6cc2f81b0a66f855d7dbba338d46038c903ef1320bb9b624471e6fba","observation_id":"e505e7bb-a76b-40b0-9b1a-fca11e922535","resolution":{"observed_at":"2026-08-10T22:40:31.870023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.873323Z","title":"Adaptive drl-based task scheduling for energy-efficient cloud computing,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.873323Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:3f15526bc1b3174d8ba120943d984cbc5204b8e91ca33be39b453d1373d9d8a5","observation_id":"35a3a0c2-a925-4e0c-9147-e7bf621407d3","resolution":{"observed_at":"2026-08-10T22:40:31.873323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.876561Z","title":"Optimizing energy efficiency for data center via parameterized deep reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.876561Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:75fae4c6c67b990177adcedec098e48a28fc25bbc0de89932d2552acedab8992","observation_id":"746c6c3e-9976-40dc-8e90-c182c10e3819","resolution":{"observed_at":"2026-08-10T22:40:31.876561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.880076Z","title":"An agent-based model for resource provisioning and task scheduling in cloud computing using drl,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.880076Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:425db6f86ae75ed41136d7246f7042ce86787ad131b1eea8697102067d251251","observation_id":"6e72e158-4763-40bb-94a2-b820ab70f19b","resolution":{"observed_at":"2026-08-10T22:40:31.880076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.883670Z","title":"Deep reinforcement learning enhanced greedy optimization for online scheduling of batched tasks in cloud hpc systems,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.883670Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:b3a729660eedc7a1c2691ea304f04e577cc54e1c836cc07c8f01a961f8040485","observation_id":"0f991374-0bc1-4152-b1cd-89b2d217a187","resolution":{"observed_at":"2026-08-10T22:40:31.883670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.887218Z","title":"Ddqn-ts: A novel bi- objective intelligent scheduling algorithm in the cloud environment,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.887218Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:865cf62033f483ee50d0eca8c1340cd244cf175ee6130760aa93680cba247f37","observation_id":"5a8d8c88-afb3-4fbb-bf86-570cd62fc718","resolution":{"observed_at":"2026-08-10T22:40:31.887218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.890839Z","title":"Task scheduling for mobile edge computing leveraging deep reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.890839Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:6c02be30b451d38e15c8726f039f47306aa1da67b3b13887f8c25a81ef8931b0","observation_id":"e319524c-95d2-41e2-b68c-85cc0568bdbe","resolution":{"observed_at":"2026-08-10T22:40:31.890839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.894279Z","title":"Online dispatching and fair scheduling of edge computing tasks: A learning- based approach,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.894279Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:74179d912b98b4b754e2ee3398da667fdc61f19b5fb03bc7e8c1953abc716cb1","observation_id":"b0cfc37b-490a-4328-b720-3b67d00309b1","resolution":{"observed_at":"2026-08-10T22:40:31.894279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.897750Z","title":"Improved double deep q network-based task scheduling algorithm in edge computing for makespan optimization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.897750Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:d9707df56da83abddedffda22c46fdf0897e956a5ef8ffcbcd5e7e16e27e1c22","observation_id":"1c97af57-e218-4807-9128-f91de820ba0e","resolution":{"observed_at":"2026-08-10T22:40:31.897750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.901096Z","title":"A double deep q-learning model for energy-efficient edge scheduling,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.901096Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:64dc0554e9e3112822c4aac3512dca75af32b190fae6134a0c20340ebe91f6ae","observation_id":"7e7e3b90-ebc6-44c1-974d-39b334a0f7b8","resolution":{"observed_at":"2026-08-10T22:40:31.901096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.904647Z","title":"Optimal policy characterization enhanced proximal policy optimization for multitask scheduling in cloud computing,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.904647Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:4c2b4ab4d390eeb445bb5885373c7e446c943b97db67138c628138b5103b40e9","observation_id":"460ccf21-2160-43e0-bd1c-0f2d9733c57c","resolution":{"observed_at":"2026-08-10T22:40:31.904647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.908098Z","title":"Cloud task scheduling based on proximal policy optimization algorithm for lowering energy consumption of data center","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.908098Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:c34a24f100aadfe0046464ac9108d31b8f0f59e03361d6b11270ecc58106edb0","observation_id":"1d24a02c-3a0e-4a4a-8485-4ee8a0074e39","resolution":{"observed_at":"2026-08-10T22:40:31.908098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.911294Z","title":"A deep reinforcement learning approach to resource management in hybrid clouds harnessing renewable energy and task scheduling,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.911294Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:ab46849925c620a9bac48c47ed4190a06dddaad578214bc2483bd61288603cb6","observation_id":"8c9c1935-37dc-4ee9-ad3f-36f188b01beb","resolution":{"observed_at":"2026-08-10T22:40:31.911294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.914770Z","title":"Slas-aware online task scheduling based on deep reinforcement learning method in cloud environment,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.914770Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:c58dfc05ca297cfa3a8ab6c2d0b3b66ee009f4b2ff9e68f8fc93e6f85615af58","observation_id":"259a94a8-0ce0-4a18-a947-50246007b633","resolution":{"observed_at":"2026-08-10T22:40:31.914770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.918735Z","title":"Performance and cost-aware task scheduling via deep reinforcement learning in cloud environment,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.918735Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:a0cdc411e129ba5e04af2195c903ced0bd2d9b2acff9158ff73e84081a3573cc","observation_id":"3f7d7041-07fe-44c6-9cde-9e5cf8fac2da","resolution":{"observed_at":"2026-08-10T22:40:31.918735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.922150Z","title":"Etpam: An efficient task pre- assignment and migration algorithm in heterogeneous edge-cloud computing environments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.922150Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:a8c0a719aef3559461d49f3c717367913b99e15d8d816f113eac768572189fc2","observation_id":"59f8099a-c455-48f9-aacb-5831ace41f77","resolution":{"observed_at":"2026-08-10T22:40:31.922150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.925631Z","title":"Dynamic scheduling for stochastic edge-cloud computing environments using a3c learning and residual recurrent neural networks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.925631Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:58ede5c0aa86d303585cfe7ea7e58b50e8978566f445149437163a6df3160e7a","observation_id":"59b8210f-0900-485d-8510-3dfc2a0b83c3","resolution":{"observed_at":"2026-08-10T22:40:31.925631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.929110Z","title":"Online joint scheduling of delay-sensitive and computation-oriented tasks in edge computing,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.929110Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:25c320bc0054aafef71c16f22da04ca2d913256462de6bf57a9c26892b4a032d","observation_id":"121c229f-ff4c-43a7-ba8c-3eb43474d8d5","resolution":{"observed_at":"2026-08-10T22:40:31.929110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.932926Z","title":"Dynamic task allocation and service migration in edge-cloud iot system based on deep reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.932926Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:9b891d3d087286ea929bff59b7de0508ab29deecd7640e0c984d4b66d63afbdd","observation_id":"7605cc40-7069-4896-bad7-12d93e23dc6e","resolution":{"observed_at":"2026-08-10T22:40:31.932926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.936625Z","title":"Reliability-aware: task scheduling in cloud computing using multi-agent reinforcement learn- ing algorithm and neural fitted q","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.936625Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:3b111dedad10c0c91dda1fc22ab6ebd900389c9152153d30e4c943ba92e4bc43","observation_id":"2b59f966-de20-4ee5-ad05-1b4a842b4d52","resolution":{"observed_at":"2026-08-10T22:40:31.936625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.940107Z","title":"Orchestrated scheduling and multi-agent deep reinforcement learning for cloud- assisted multi-UA V charging systems,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.940107Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:680587073410fe411fb992f6c7124b0bfc1b2f07dfcbf93fda210fae84fabab5","observation_id":"b09ae5c7-951d-4101-a98e-fec64dcfc4c4","resolution":{"observed_at":"2026-08-10T22:40:31.940107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.943633Z","title":"Multi-agent deep reinforcement learning for collabo- rative task scheduling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.943633Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:a73d158d70d39cbcf90f8d765ce6c19c057e1a33757f87171c4b20a92a3a777c","observation_id":"f8eee3d9-2765-4c34-b49c-c1c73fd779a2","resolution":{"observed_at":"2026-08-10T22:40:31.943633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.947174Z","title":"Multi- agent deep reinforcement learning for online request scheduling in edge cooperation networks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.947174Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:b9228054550a25c2112d0b0cd260c25dfef0e19fe88fd37e5f962ea57bfc8211","observation_id":"d3738f3c-3d73-4d77-959f-4db6e02aa533","resolution":{"observed_at":"2026-08-10T22:40:31.947174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.951074Z","title":"Distributed task scheduling in serverless edge computing networks for the internet of things: A learning approach,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.951074Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:0535cdb8e1091e6b8273d47c4fa9ba802a3ef9450e6a523527482b5cca9ece7f","observation_id":"f4381d5a-ccc0-4bac-910a-3d1449bf0c8d","resolution":{"observed_at":"2026-08-10T22:40:31.951074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:40:31.954544Z","title":"Multi-agent reinforcement learning based distributed transmission in collaborative cloud-edge systems,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-10T22:40:31.954544Z"},"links":{"citing_paper":"/paper/2501.01007"},"observation_digest":"sha256:af688e95db7b545abf018a0857f852d6c72ebb4c619740eed55f7efb72ff1633","observation_id":"13722afd-7b3c-409e-b385-123688f2964b","resolution":{"observed_at":"2026-08-10T22:40:31.954544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.01007","last_updated":"2025-01-02T02:08:00Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-17T16:21:33.478770Z","submitted_at":"2025-01-02T02:08:00Z","title":"Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":220},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 100 of 220 outbound references and 3 inbound Pith citation observations for arXiv:2501.01007."}