{"as_of":"2026-08-10T05:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7caff85b70c99f6ed77c49d067213f81252a81bb22e253767b35188b7da2e2e5","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:45:59.171024Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.10474/citation-record","integrity":"/paper/2509.10474/integrity","json":"/paper/2509.10474/citation-record.json","paper":"/paper/2509.10474"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.706517Z","title":null,"venue":null,"work_id":"285a1540-e855-4a63-9bdd-bee18fc61a23","year":2024},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.612109Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:979333760373a9b7876e53274ace5606aac461f7fffdac80160390f7313bf074","observation_id":"d7b9194f-ecd1-443c-91ea-8d451e0095b5","resolution":{"observed_at":"2026-08-05T15:46:00.713962Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.684749Z","title":"Deep reinforcement learning based computa- tion offloading and resource allocation for mec","venue":null,"work_id":"83d90d2b-fec1-4600-842c-0150b31b312d","year":2018},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.645005Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:f6b344fbac0aec3d7b98348ab1b03d4cf0a9a1088a10cdd2e015376e44a40a2b","observation_id":"32f86494-404a-4b00-9086-5ce60d5e9f7f","resolution":{"observed_at":"2026-08-05T15:46:00.694894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12389","last_updated":"2019-04-28T22:14:22Z","snapshot_observed_at":"2026-07-06T07:49:03.753401Z","submitted_at":"2019-04-28T22:14:22Z","title":"Optimal Task Assignment and Power Allocation for NOMA Mobile-Edge Computing Networks","version":1},"cited_work":{"arxiv_id":"1904.12389","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.12389","snapshot_observed_at":"2026-08-05T15:45:59.357104Z","title":"Optimal Task Assignment and Power Allocation for NOMA Mobile-Edge Computing Networks","venue":"cs.IT","work_id":"aed94142-1476-42cf-be63-d8d3b84c55f6","year":2019},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.664742Z"},"links":{"cited_paper":"/paper/1904.12389","citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:45dfbbb7db777d538ef3d2ac40c770ff0fc8612d316a9ffd022e17ba1a41f0f7","observation_id":"aea3afa1-ccbd-4f07-833b-651937fedc0b","resolution":{"observed_at":"2026-08-05T15:45:59.366517Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.655934Z","title":"Joint task offloading and resource allocation for multi-server mobile-edge computing networks","venue":null,"work_id":"db5e50cf-06e4-4a47-bfd3-718c6c843102","year":2018},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.696270Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:f98ce60eefc42f5cac9fbe942df3623f6a2fd75aab190bb5ac0515c992108b71","observation_id":"7a76ca0c-2e29-4d4b-aefe-095b8aa7a6c7","resolution":{"observed_at":"2026-08-05T15:46:00.664051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.634375Z","title":"Latency and energy optimization for mec enhanced sat-iot networks","venue":null,"work_id":"63cdcabb-02a6-4ab5-bc51-c18b22d419c3","year":2020},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.701806Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:eb39d5792acb6ca605eea24d03d1bebe89a56fd492f7768138d5679d4f87e108","observation_id":"086f256a-8ecb-4719-9bd9-6cb5b1ae4691","resolution":{"observed_at":"2026-08-05T15:46:00.642420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.618080Z","title":"Multiuser resource control with deep reinforcement learning in iot edge computing","venue":null,"work_id":"70690984-aef8-4464-b536-f48308cfedd9","year":2019},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.710004Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:9287bdf85cd3746563faa3a17cd5c98911f4d6ce696b644b3ef50e2ddf777ecd","observation_id":"ba0ed769-d6a5-4474-bfb1-f785b667533a","resolution":{"observed_at":"2026-08-05T15:46:00.623140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.595300Z","title":"Stacked autoencoder-based deep reinforcement learning for online resource scheduling in large-scale mec networks.IEEE Internet of Things J., 7(10):9278–9290, 2020","venue":null,"work_id":"62abbe0e-5d70-4fe5-93f9-0afa3c8658bd","year":2020},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.729198Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:bf10d921389c92e283fd2d7eb5b1f65a2fc7731cee3f4788cbbd06c0e687f3c6","observation_id":"a0bdd881-3385-474c-8b47-60f2e766c7aa","resolution":{"observed_at":"2026-08-05T15:46:00.602013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.574468Z","title":"A survey of multi-objective sequential decision-making","venue":null,"work_id":"8db5bd6b-467a-4d24-893a-181579963921","year":2013},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.739587Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:e1d162e90599ca6cc0052392f491b3cc6fa1e0ce16f05e8ab00af799c2bea245","observation_id":"9bf8e18f-dc93-487d-9b3a-c1b1777a25d8","resolution":{"observed_at":"2026-08-05T15:46:00.583880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.556695Z","title":"A generalized algorithm for multi- objective reinforcement learning and policy adaptation","venue":null,"work_id":"5950217f-cbff-4c44-a190-696348737382","year":2019},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.759241Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:1db87b2358ce97e07f356dc811ef3f3b386491234496e68cb57b8f39d993b4db","observation_id":"21653ce9-eab0-4800-a246-8f7427b0304f","resolution":{"observed_at":"2026-08-05T15:46:00.562205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.495471Z","title":"Offloading and resource allocation with gen- eral task graph in mobile edge computing: A deep reinforcement learning approach","venue":null,"work_id":"3e849c57-891e-4c81-89de-8b616402f423","year":2020},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.785704Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:9f6dce72f2b766b275144545a6d5c952f7a69dbb43d4dda73d91985cf63a8b3b","observation_id":"4bd5a2ee-c1f7-4357-a13e-ac9c99930f87","resolution":{"observed_at":"2026-08-05T15:46:00.510911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.465486Z","title":"Gasto: A fast adaptive graph learning framework for edge computing empowered task offloading","venue":null,"work_id":"b7bdf99d-eabe-4f64-b5d0-57cd2d6dc756","year":2023},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.806314Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:c7f43310292d0081b0971f0121f576eb64ef848e1ea2b6004089713141d004f2","observation_id":"477080f3-c6b3-435b-a461-ad20bf26eb6f","resolution":{"observed_at":"2026-08-05T15:46:00.483861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.435877Z","title":"Fast adaptive task offloading and resource allocation in large-scale mec systems via multi-agent graph reinforcement learning.IEEE Internet of Things Journal, 2023","venue":null,"work_id":"16917c5a-b5cc-4905-9e3b-46ef578669f4","year":2023},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.834747Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:b2b576c5e38c6f025181881190d812220d1042006e41ce84f72720a1ff8674f1","observation_id":"b7508013-69b5-4d07-8ebc-9a7cb433ed35","resolution":{"observed_at":"2026-08-05T15:46:00.444739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.372576Z","title":null,"venue":null,"work_id":"17cd2c87-e547-4ebf-ba46-e8ab042c2b02","year":2022},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.864746Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:32147c1c4d03f3f16079a19b31a07eb3cd8f8960c16b1ec9c5362dce36f4af29","observation_id":"028f285b-bd85-4316-b8ad-fa6651a6a513","resolution":{"observed_at":"2026-08-05T15:46:00.390508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.340475Z","title":"Deep reinforcement learning for online computation offloading in wireless powered mobile-edge computing networks.IEEE Transac- tions on Mobile Computing, 19(11):2581–2593, 2019","venue":null,"work_id":"a863ef06-65e8-4b6b-8004-cad76cc0d0c9","year":2019},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.885849Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:a6ac5f1cbd7be367bb8ef072cc3f9210d95da25acb60142a3f7d0e62e14c7853","observation_id":"d25cefe1-9757-4bcb-aa78-a5bd36d1c37d","resolution":{"observed_at":"2026-08-05T15:46:00.361425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:58.891935Z","title":"Domain randomization for transferring deep neural networks from simulation to the real world","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.891935Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:3708706ccbb1afc4ccedee23f89dfb3b9f47ae85ae95593dd81189bec69cc5d6","observation_id":"ebded80a-5948-4f94-a989-09100b04455e","resolution":{"observed_at":"2026-08-05T15:45:58.891935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.256370Z","title":"A practical guide to multi-objective reinforcement learning and planning","venue":null,"work_id":"077163db-dd11-4264-9811-94633d155873","year":2022},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.913596Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:1cb1e73601b2298e1889cad080136831ef3731b30ab431cb29b7b973b299e0be","observation_id":"d5ca0801-9a36-456b-9344-8e4aca923fdc","resolution":{"observed_at":"2026-08-05T15:46:00.264776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09794","last_updated":"2023-01-19T10:32:33Z","snapshot_observed_at":"2026-08-08T20:46:12.193389Z","submitted_at":"2021-11-18T16:53:02Z","title":"A Survey of Zero-shot Generalisation in Deep Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09794","snapshot_observed_at":"2026-08-05T15:45:58.928009Z","title":"A survey of generalisa- tion in deep reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.928009Z"},"links":{"cited_paper":"/paper/2111.09794","citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:0fdd58cf00445cb2959ff13adbbdb05780a94fd0d493bed9ce6a6eeb86e239ec","observation_id":"121605d9-f04c-4902-b43f-7415e9ee3f99","resolution":{"observed_at":"2026-08-05T15:45:58.928009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.199769Z","title":"Why generalization in rl is difficult: Epistemic pomdps and implicit partial observability","venue":null,"work_id":"243fb3e9-6aa3-407b-af0d-cd84fa365264","year":2021},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.933567Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:bef2da670217d7a3f7c524b3dd039e48c37c8cb90bbb1a46c3065e5ea2c80ae3","observation_id":"2efbddf4-8fe1-4162-b334-dc87e1f0a4f6","resolution":{"observed_at":"2026-08-05T15:46:00.206143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.147255Z","title":"Deep reinforcement learning for collaborative offloading in heterogeneous edge networks","venue":null,"work_id":"c2a09476-a562-4248-94ca-8de5442cf08f","year":2021},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.938519Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:d07bf13fdb1936e619f7452976949f210cb320c0c511c8c3ce62ff3fdb488820","observation_id":"e3b5467c-0fc0-4103-bea1-5d6137ff0dc8","resolution":{"observed_at":"2026-08-05T15:46:00.155397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.128554Z","title":"Distributed resource schedul- ing for large-scale mec systems: A multiagent ensemble deep reinforcement learning with imitation acceleration","venue":null,"work_id":"aefbb533-d344-419c-a588-135f4aa98c0f","year":2021},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.946128Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:29023be5818203025966965f0760cc7758e33fb440e9370ee83dbdfcfe443b7f","observation_id":"be6bcee6-d9b3-4f91-bf17-1a06b233dad6","resolution":{"observed_at":"2026-08-05T15:46:00.134619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.073835Z","title":"Fast adaptive task offloading in edge computing based on meta reinforcement learning","venue":null,"work_id":"ef9b005a-3f28-4676-b814-9d1073d83a87","year":2020},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.951301Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:e963df7c4433c01074647d89c014138b9f9832df67fe8bf928df008e06f7d99c","observation_id":"8588e67c-41da-42c2-a05c-19b8d049a6f9","resolution":{"observed_at":"2026-08-05T15:46:00.105661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:46:00.036402Z","title":"A scalable com- putation offloading scheme for mec based on graph neural networks","venue":null,"work_id":"62f5968e-daa3-4c24-98f4-76b0ff9b4599","year":2021},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.969889Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:c0695f345ee237bf57c95a18b0da23aac5bc249f8ea9ac92a8d998de6454bfe7","observation_id":"4b1d4023-98d8-4bb4-8954-9c55ded285dc","resolution":{"observed_at":"2026-08-05T15:46:00.046650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.991694Z","title":"Achieving fast environment adap- tation of drl-based computation offloading in mobile edge computing","venue":null,"work_id":"ca894a18-134d-4e27-898f-2083a4ede243","year":2023},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.981753Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:74795f36526b810cd4034e3605f7658fad0484c00708a4f1dffcdf449880db15","observation_id":"d6302117-57c1-41b5-8a37-ac7ac7cfa729","resolution":{"observed_at":"2026-08-05T15:46:00.004783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.945432Z","title":"Multi-objective deep reinforcement learning for mobile edge computing","venue":null,"work_id":"1237ca34-f042-4822-8698-d0caab87e34f","year":2023},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:58.998135Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:fe3d85ac4f1ad455a4370e1254a24cfadce0bcbd5725d35bf2225b4473fd747b","observation_id":"e215ba17-344e-4d50-bc67-4135d3f6b60d","resolution":{"observed_at":"2026-08-05T15:45:59.950911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.905663Z","title":"Attention-based deep reinforcement learning for edge user allocation","venue":null,"work_id":"5acf9bfa-2c72-400f-b88d-7ff672e2dad6","year":2023},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:59.024883Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:31efc00c8794525e8b51bb71c88b772af07d8cd9a5b3c45fef9f252e090e40b2","observation_id":"b8e4e654-f9f1-4550-8b4a-48003a6b1fc2","resolution":{"observed_at":"2026-08-05T15:45:59.914759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.885197Z","title":"Joint computation offloading and multiuser scheduling using approximate dynamic programming in nb-iot edge computing system","venue":null,"work_id":"dcd5bda4-44d3-4a48-b8e0-f6e6526f66b7","year":2019},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:59.054013Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:72cebc3da360c8085dab8b2517ab1b6178782723fbf05fb17d0b8fd5b286baa6","observation_id":"03294243-ea2a-4c88-a85c-07dc470b825d","resolution":{"observed_at":"2026-08-05T15:45:59.892479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.836047Z","title":null,"venue":null,"work_id":"ae805f8c-76c3-4fb4-9be2-a3994149be9a","year":2020},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:59.059375Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:ea1c0b82552b1c037834379ef9f548c6de5a35c69b37b23e1de46c78b71a65fb","observation_id":"17db68ac-9a7f-49f1-85ce-8d7afc10d963","resolution":{"observed_at":"2026-08-05T15:45:59.842059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.811440Z","title":"Policy gradient methods for reinforcement learning with function approximation","venue":null,"work_id":"fa0e2018-b8c0-4762-8ca8-4c20c68e18ba","year":1999},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:59.063685Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:6a291eb416000a8a5e5b6ff320ae0e10fe53202ff3f5d9828c625ca7d54a98a5","observation_id":"0d769ee8-dc19-4d00-83f7-6cf8bf25ae77","resolution":{"observed_at":"2026-08-05T15:45:59.818807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07207","last_updated":"2019-10-18T09:17:44Z","snapshot_observed_at":"2026-08-06T11:56:09.577967Z","submitted_at":"2019-10-16T08:11:08Z","title":"Soft Actor-Critic for Discrete Action Settings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07207","snapshot_observed_at":"2026-08-05T15:45:59.079116Z","title":"Soft actor-critic for discrete action settings","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:59.079116Z"},"links":{"cited_paper":"/paper/1910.07207","citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:3d6562cb9315fc881ef3690e71f8d880de4a2187d27e74d61f6112e8b3877cb4","observation_id":"fd073855-f9c5-42f0-b93a-14c5a3161913","resolution":{"observed_at":"2026-08-05T15:45:59.079116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.781996Z","title":"Policy gradient approaches for multi-objective sequential decision making","venue":null,"work_id":"dcafdb32-9b53-45f4-8a3d-4d97624855c3","year":2014},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:59.084231Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:7cc9561997dcb1bc4b651ea2a4aef648cedd82ed9c17b793c85f863240812195","observation_id":"d62d36ac-477c-4433-870b-7b30036cb68b","resolution":{"observed_at":"2026-08-05T15:45:59.789417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.734086Z","title":"IEEE Std 802.11a-1999 , pages 1–102, 1999","venue":null,"work_id":"7781d727-a932-4175-9fa5-21103c8a17a2","year":1999},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:59.091483Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:faaf16e98b8411d764871e6294b442e39332f7281159bd10e69ad8e7573352b3","observation_id":"95db9a2e-e657-40be-914e-8b7919a5dd54","resolution":{"observed_at":"2026-08-05T15:45:59.750117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.712912Z","title":"A contextual-bandit approach to personalized news article recommendation","venue":null,"work_id":"5e52694f-18a6-4a7a-8981-61b40f88a9c2","year":2010},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:59.099703Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:c53914caa2a98d0563303e3c86b18f775663cac12e935db276061d4f3f5978fa","observation_id":"c0493b91-8311-4337-a1af-fa32b360b87b","resolution":{"observed_at":"2026-08-05T15:45:59.718399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.692575Z","title":"Task replication for vehicular cloud: Contextual combinatorial bandit with delayed feedback","venue":null,"work_id":"a14c8a84-79f1-438a-981f-cf603dd2d6ca","year":2019},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:59.107946Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:75364d0932c916b6a639b12fd6ee084dd9addc383158d3d9427c48cfb8154f7e","observation_id":"a37da4c7-cb86-47b0-b6c2-977d41f66c03","resolution":{"observed_at":"2026-08-05T15:45:59.699378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.668600Z","title":"Collaboration-aware relay selec- tion for auv in internet of underwater network: Evolving contextual bandit learning approach","venue":null,"work_id":"807c02d2-d1f3-48c8-9ec2-1802e2227d18","year":2022},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:59.121441Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:6149813feee610114d3c53d37617415fa56407fdfa17c94f4d488cc31e08e686","observation_id":"3467b482-9bd5-499c-9f0b-17374f194697","resolution":{"observed_at":"2026-08-05T15:45:59.675372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.625872Z","title":"Computation rate maximization for wireless powered mobile- edge computing with binary computation offloading","venue":null,"work_id":"ec7ff8e0-d53b-43ac-b20d-399c329490e4","year":2018},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:59.134528Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:986fd847b182f7aafdd99f32b3ab6a4e5e3dda19292205b0df6f53f8a7fb8f57","observation_id":"0762eb1b-e3cc-4dc3-865d-991c7e296955","resolution":{"observed_at":"2026-08-05T15:45:59.635242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.552930Z","title":"A fast and elitist multiobjective genetic algorithm: Nsga-ii","venue":null,"work_id":"e46cd72a-e50e-47ad-a711-b937fa755042","year":2002},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:59.140119Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:b36c0bea8411fa8792ac768df8bdcc4241c036f54c4824458bae0bc79eb4773f","observation_id":"9e3abb8f-0de1-4c50-b648-500a572c93cf","resolution":{"observed_at":"2026-08-05T15:45:59.584751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.498229Z","title":"A comprehensive survey on nsga-ii for multi-objective optimization and applications","venue":null,"work_id":"73065075-4f38-4b41-bccd-ee2087173c87","year":2023},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:59.151001Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:5184bc127dacad4853f22bea291ed7cf027702340a89f0c6b2f1002cc52f0170","observation_id":"28f01825-3536-43d5-93d4-42f2b127afe7","resolution":{"observed_at":"2026-08-05T15:45:59.513328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.454759Z","title":"Multi-objective reinforcement learning using sets of pareto dominating policies","venue":null,"work_id":"70d0a662-dfb4-4556-8540-6564833a66e3","year":2014},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:59.165263Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:225843175a8353192bad4cf3145f0574c055ba3053e68ac9513cfe3566be931c","observation_id":"7e320d4b-f295-4120-a6ef-601a07eccd5a","resolution":{"observed_at":"2026-08-05T15:45:59.464740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:45:59.393862Z","title":"X m∈M γm(ωT Tm(πt) + ωEEm(πt)) # −","venue":null,"work_id":"10c36d6f-45fe-482b-9edc-b87da1e0bff5","year":2005},"citing_paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T15:45:59.171024Z"},"links":{"citing_paper":"/paper/2509.10474"},"observation_digest":"sha256:df0d9e5d759e35f64c90b3534906acfb71be80bb9782660b7adcabf966fed651","observation_id":"e9cc239d-fe7a-41df-a453-ecd5e579082f","resolution":{"observed_at":"2026-08-05T15:45:59.410526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.10474","last_updated":"2025-08-27T06:14:38Z","latest_version":1,"primary_category":"eess.SY","snapshot_observed_at":"2026-08-08T04:01:02.980358Z","submitted_at":"2025-08-27T06:14:38Z","title":"Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":1,"verified_fuzzy":32},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2509.10474."}