{"as_of":"2026-08-15T13:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d6d2c07cf395b8325a002fd2af1440b9925fa4a2a37a6537721edb0f18ad6bba","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:12:24.068352Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.14487/citation-record","integrity":"/paper/2507.14487/integrity","json":"/paper/2507.14487/citation-record.json","paper":"/paper/2507.14487"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:30.767483Z","title":"Reinforcement learning: A tutorial survey and recent advances,","venue":null,"work_id":"24f2106f-b018-475b-861e-ec5b2ffb6240","year":2009},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:19.977331Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:ce625d17e906001d32ae69a5d9e5926d44d87669a192aea33c8fbbb84eaf7c51","observation_id":"528db44d-f2b1-4cd7-8d49-126957beac53","resolution":{"observed_at":"2026-08-06T16:12:30.830265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:30.593160Z","title":"Deep reinforcement learning: A brief survey,","venue":null,"work_id":"2c69fb2c-f061-4d4a-9279-231bfe9e8d69","year":2017},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:20.067141Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:9b69957365a163ba8e3f8b8f2ce89367011d76f594196a67c183dc03d02d8b37","observation_id":"062efd2b-1ece-47e8-91f9-147c16a9b468","resolution":{"observed_at":"2026-08-06T16:12:30.682290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:30.370196Z","title":"Applications of deep reinforcement learning in communications and networking: A survey,","venue":null,"work_id":"e5064356-d58d-470d-8026-588660e054c8","year":2019},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:20.181766Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:b6c1c9e0a32debcd3b4eb6243dd1ba28201068257f46faae061cfbb2ddca619f","observation_id":"f5fe3583-735b-489f-8516-71721b684853","resolution":{"observed_at":"2026-08-06T16:12:30.485060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:30.202916Z","title":"Federated reinforcement learning for fast personalization,","venue":null,"work_id":"839f632a-bcf6-424e-b820-c2201233d221","year":2019},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:20.297709Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:36dbfc53afbbcd370951db6d56876c84adb1109128443d165a2adc3678f03e55","observation_id":"4e2aacc0-8782-489f-9b2e-2f2803f122d2","resolution":{"observed_at":"2026-08-06T16:12:30.286821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:30.071027Z","title":"Fed- erated reinforcement learning: Linear speedup under markovian sampling,","venue":null,"work_id":"5e8ea673-7222-43f9-8365-f7eeb8e4f03c","year":2022},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:20.386826Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:c23db7cd6ca75a4825b8e1cf86e6dc6991b609bc818796eb38edbcdf85eb430f","observation_id":"476ffc8a-9cbd-4939-9904-cb7b3573bc37","resolution":{"observed_at":"2026-08-06T16:12:30.123329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.11887","last_updated":"2021-10-24T19:02:03Z","snapshot_observed_at":"2026-08-14T06:46:44.360866Z","submitted_at":"2021-08-26T16:22:49Z","title":"Federated Reinforcement Learning: Techniques, Applications, and Open Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.11887","snapshot_observed_at":"2026-08-06T16:12:20.480072Z","title":"Federated reinforcement learning: Techniques, applications, and open challenges,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:20.480072Z"},"links":{"cited_paper":"/paper/2108.11887","citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:98f78d808baa5767280daf43f35d1f26e461ba10021a5b75145ba5c94f9eea71","observation_id":"49c703eb-fb1c-40a6-8848-f03bdff75082","resolution":{"observed_at":"2026-08-06T16:12:20.480072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:29.930167Z","title":"Fedkl: Tackling data heterogeneity in fed- erated reinforcement learning by penalizing kl divergence,","venue":null,"work_id":"c7429dfd-b6e7-4903-8846-653e62e4ddf2","year":2023},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:20.591244Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:87a6577fe7088f9419fb5a7a41aeeaee178db82ac32b894a3d7514914635006b","observation_id":"213723f3-a2d4-4648-8b63-6f456175dbb1","resolution":{"observed_at":"2026-08-06T16:12:29.991757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:29.856661Z","title":"Federated reinforcement learning acceleration method for precise control of multiple devices,","venue":null,"work_id":"c0eb8399-9da8-4ae7-a974-6ee76da91eab","year":2021},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:20.700082Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:e6cbd75fdc5bbe0d561c036a2d31e65bc4c13304adabcf896ebfd7da4e353833","observation_id":"7ae16e3d-4a36-49e1-949a-2f51333ab3f0","resolution":{"observed_at":"2026-08-06T16:12:29.895363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:29.669256Z","title":"Federated reinforcement learning with environment heterogeneity,","venue":null,"work_id":"eac60556-234b-431a-b567-55888a473fc2","year":2022},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:20.782955Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:1eea0e52e1c256507738022f03a684348c10ab42baf85b57ab78539115954bf0","observation_id":"14d1be60-88ad-40ed-af45-a5562e416caa","resolution":{"observed_at":"2026-08-06T16:12:29.784029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:29.460810Z","title":"Communication-efficient randomized algo- rithm for multi-kernel online federated learning,","venue":null,"work_id":"c35bcada-73f0-4c8f-a15e-c23299a85f61","year":2021},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:20.857793Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:55e5236bb4095953c9db11d046a5b439d50717e6d2b505075d2a1395a1070f66","observation_id":"e21d357a-ca68-4513-8f1e-60d449131fa8","resolution":{"observed_at":"2026-08-06T16:12:29.586662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:29.261705Z","title":"Communication-efficient online federated learning framework for nonlinear regression,","venue":null,"work_id":"6fe165b3-628d-4860-829d-64a28c9f4d87","year":2022},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:20.942976Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:c27e9e01394bb59c138e7b3ec581ee9ddad8e3c5acd16df4e9a8df6ef40fd75a","observation_id":"14e06a59-f6cb-47ba-b7ed-f550dff206c8","resolution":{"observed_at":"2026-08-06T16:12:29.356968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:29.071137Z","title":"Tighter regret analysis and optimization of online federated learning,","venue":null,"work_id":"658fdbc2-1b1b-4604-bf61-5e4c9b0ec768","year":2023},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:21.045995Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:8b554ebc805f2ee81388b87151d2bd6333e8c6cbb23e47f66052b64cdda32943","observation_id":"0f0a9860-fad5-4b07-b6ca-aea951fe5fd6","resolution":{"observed_at":"2026-08-06T16:12:29.159499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:28.869336Z","title":"Online multikernel learning method via online biconvex optimization,","venue":null,"work_id":"94056f01-839f-4574-bac3-cfd6d233df71","year":2023},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:21.187880Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:6a705e1bc85b9b8983acfdee3d7986ab6938279a77cde9c5ba2f1b90731f143a","observation_id":"046a4929-ac9c-4d3c-90ae-c0207651a362","resolution":{"observed_at":"2026-08-06T16:12:28.963808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:28.709271Z","title":"A communication- efficient adaptive algorithm for federated learning under cumula- tive regret,","venue":null,"work_id":"8b585ff8-ff6f-464e-b767-ee045377f853","year":2024},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:21.316167Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:1e94e2e0d04953a61ec1a529866f99490b2e7806c65eb3657bf5fc5058ffc307","observation_id":"54efb7e3-ef74-49cc-8fa1-844875d5c685","resolution":{"observed_at":"2026-08-06T16:12:28.798093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:21.442387Z","title":"Learning to predict by the methods of temporal differences,","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:21.442387Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:adba5eec62a5d11d50ce1fda653a942e41b589b4b3488b007ad6d82f970bf9d5","observation_id":"143661a5-cb6d-47f4-9f93-4f2b771395ce","resolution":{"observed_at":"2026-08-06T16:12:21.442387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:28.507014Z","title":"Q-learning,","venue":null,"work_id":"f0cabecb-8ebd-483e-b75a-c7b825cc7995","year":1992},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:21.571131Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:41c47c0e718f156dfdb8e4045b08dfb06b0e328aaca301715a11a63fc312dfa3","observation_id":"be2a8b9c-0f35-4ff9-8a1b-f8179048bc84","resolution":{"observed_at":"2026-08-06T16:12:28.601011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:28.309476Z","title":"Learning from delayed rewards,","venue":null,"work_id":"f394e3ab-8633-400b-b6b1-013034e7aaa7","year":1989},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:21.692251Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:886e173b17e4dec0bb62b97c0a9cb242ab642d077e32f559753ba1e6f07b965b","observation_id":"f4a65604-7271-4ab6-b2fb-0a1a114616c5","resolution":{"observed_at":"2026-08-06T16:12:28.436359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-14T03:19:40.736445Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-06T16:12:21.787378Z","title":"Playing atari with deep reinforcement learning,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:21.787378Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:e7778473f036e08c1ed655599b60b6156db7dfbb16728a1dc4db6b9da29fd3fe","observation_id":"79f82118-27bf-481a-b2ca-a9c0c2c6e14d","resolution":{"observed_at":"2026-08-06T16:12:21.787378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:28.146733Z","title":"Policy gradient methods for reinforcement learning with function ap- proximation,","venue":null,"work_id":"b7350188-b8d4-4e2a-89c8-f6fcec8b2ef0","year":1999},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:21.892685Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:ed1595695ec6f393f1bcf285f0d9904927b876f901096ce732dcd57eff615e78","observation_id":"c71e4d52-6d73-4040-bcf6-6b55af7f9448","resolution":{"observed_at":"2026-08-06T16:12:28.222088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:27.968608Z","title":"Deterministic policy gradient algorithms,","venue":null,"work_id":"85082859-68f2-45ac-a473-9ba0f818bef3","year":2014},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:22.016168Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:e509be2445ff764fbbfd3c55b330c2585a7177874017b51d604e6e403eb40f85","observation_id":"1064bce0-d32b-45d5-a84e-b48bc30352b1","resolution":{"observed_at":"2026-08-06T16:12:28.047234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-15T12:04:28.662048Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-06T16:12:22.121894Z","title":"Continuous control with deep reinforcement learn- ing,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:22.121894Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:cdedc9b6abb331a09a2791566cd093109201bef92ab1b0c598c526b3ac6d71a5","observation_id":"d128a274-2994-41d8-b872-18e04d863a3f","resolution":{"observed_at":"2026-08-06T16:12:22.121894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:27.781072Z","title":"A survey on federated learning systems: Vision, hype and reality for data privacy and protection,","venue":null,"work_id":"6b69ff9a-877e-4a17-a36a-59d61611a7d4","year":2021},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:22.218829Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:effdf8402a225e1d5f3aa887302454fcfb590b2122fceb40c59335e152d1aec2","observation_id":"83f7929b-2632-4ed1-88cd-25835abd4f88","resolution":{"observed_at":"2026-08-06T16:12:27.846512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:22.314944Z","title":"Federated learning: Challenges, methods, and future directions,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:22.314944Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:b623fac959cb468f1a4acb52c13a5dddf5acb497ce5b7b8abf7349260fd309be","observation_id":"1f532170-b1a7-4cfa-8feb-e86242d20c55","resolution":{"observed_at":"2026-08-06T16:12:22.314944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:27.550736Z","title":"Federated machine learn- ing: Concept and applications,","venue":null,"work_id":"78ba8d21-65e8-449a-b491-15871e179dd5","year":2019},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:22.388282Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:1d3186ea072381354cebe93aefba5d9bd33caff46d789a8de6f6beefb1f082c1","observation_id":"53ba31dd-d288-4e4d-88c2-452999f1ec01","resolution":{"observed_at":"2026-08-06T16:12:27.650185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:27.356341Z","title":"Communication-efficient learning of deep networks from decentralized data,","venue":null,"work_id":"214d5213-d01e-424d-890c-ffe6dd9826c4","year":2017},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:22.449253Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:ff8c9c1e61dd54f380fe0b85e283da0e1dc3940861086c36a735d49e71aaa4d7","observation_id":"dcdbd6a2-0fdc-41ce-a9a7-47337c6dc072","resolution":{"observed_at":"2026-08-06T16:12:27.458697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:26.968858Z","title":"Lo- cal learning matters: Rethinking data heterogeneity in federated learning,","venue":null,"work_id":"90b15ef0-7df3-4bd9-b470-7998822ce036","year":2022},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:22.658943Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:15d7dba818b3a3d468685c55cb1758dd5af6f5c2623072919716a7f3035f9fc9","observation_id":"10a63445-2350-4709-8953-82c658b85cf4","resolution":{"observed_at":"2026-08-06T16:12:27.079317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:26.739479Z","title":"Tackling data heterogeneity in federated learning with class prototypes,","venue":null,"work_id":"42357f27-5dd8-4f02-98e2-cd348f3297f8","year":2023},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:22.754795Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:3ca7fc1db29f310af5f8b42580f1c4199db6f981b8b55a5ca0422967f8305407","observation_id":"564c4c15-3a8e-4342-bf4d-d4ff74f78798","resolution":{"observed_at":"2026-08-06T16:12:26.852542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:27.162148Z","title":"Federated optimization in heterogeneous networks,","venue":null,"work_id":"e0625577-312a-4f4a-b11b-48572e6f2989","year":2020},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:22.856331Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:a30e91f5945f92d009797fb805809ce486fc39097925fb8106b17d3be1c8b4b6","observation_id":"029073c3-8b4c-489e-9c35-4d843c1e5048","resolution":{"observed_at":"2026-08-06T16:12:27.266595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:26.525253Z","title":"Scaffold: Stochastic controlled averaging for federated 14 learning,","venue":null,"work_id":"f9763222-53bc-4127-b0fc-08c1ad20bc58","year":2020},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:22.949490Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:fa9e57462bce4fcc67ff5888d5912aa7f396d433c297851728f531a077fec108","observation_id":"76ecd924-f6ca-420d-8c20-c69c4132145d","resolution":{"observed_at":"2026-08-06T16:12:26.646807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:26.230755Z","title":"A novel framework for the analysis and design of heterogeneous federated learning,","venue":null,"work_id":"db0014c7-d802-48d9-8318-abc55d322fa6","year":2021},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:23.023229Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:85d6d2ec9a8240ca3065b9e9b54b1b01847dfbb3cf8a8f6632acdf799a6a6dee","observation_id":"12ea0396-5dea-407e-8841-4817c46b7600","resolution":{"observed_at":"2026-08-06T16:12:26.347029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.08277","last_updated":"2020-02-09T12:30:36Z","snapshot_observed_at":"2026-08-14T17:26:38.278654Z","submitted_at":"2019-01-24T08:25:29Z","title":"Federated Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.08277","snapshot_observed_at":"2026-08-06T16:12:23.104452Z","title":"Federated deep reinforcement learning,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:23.104452Z"},"links":{"cited_paper":"/paper/1901.08277","citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:d927216517ba8c5ee8c923baaa12c28fc48d0a546dace9a3d769d0ec649bc268","observation_id":"fe59c430-8b08-4c93-b20c-cb26c76a5ee0","resolution":{"observed_at":"2026-08-06T16:12:23.104452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:26.043219Z","title":"Lifelong federated reinforcement learning: A learning architecture for navigation in cloud robotic systems,","venue":null,"work_id":"ad3038f8-48bb-4a55-842c-ff230a9e747b","year":2019},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:23.213869Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:67f1ce27c3f20253361bb135f0d9530c877bbe9189d19732934c167884ba2b22","observation_id":"fa2bb330-273a-4ce3-89d9-ff2ecf1ced10","resolution":{"observed_at":"2026-08-06T16:12:26.150840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:25.768367Z","title":"Federated deep reinforcement learning for internet of things with decentral- ized cooperative edge caching,","venue":null,"work_id":"edef086d-c864-463e-a4d8-40dd47e6e199","year":2020},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:23.279993Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:9fcec20a52bde5417f7a2bc5503276c68f2f2a69169a0826e42e0c8fde97fe8b","observation_id":"7e56b3d5-4cc7-4836-a924-a7f782329ba7","resolution":{"observed_at":"2026-08-06T16:12:25.936469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:25.432674Z","title":"A review of safe reinforcement learning: Methods, theories and applications,","venue":null,"work_id":"70c734e8-bc6f-403b-9265-bf98168a9a44","year":2024},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:23.330683Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:7f7fb54c991b426f92b19a052ce2f7fb11e5b3fa79116be1aa192fcbd9fc8f0f","observation_id":"37a11b82-4f0a-40de-8174-44e13b346410","resolution":{"observed_at":"2026-08-06T16:12:25.595986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:23.385489Z","title":"Human-level control through deep reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:23.385489Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:840603fc3286ba81a792185c456574fcf10eeb7400c91cb0c1268614d4b0dc1d","observation_id":"470be543-1753-4c8f-bc8d-7a3b36695a67","resolution":{"observed_at":"2026-08-06T16:12:23.385489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:25.005228Z","title":"Federated learning- based computation offloading optimization in edge computing- supported internet of things,","venue":null,"work_id":"be412c70-2406-4c04-8880-77ca397b6487","year":2019},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:23.451968Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:fe1a9b0226c1d17e34082da0d76f5172a4479ad63260937cc43ef411def9f59f","observation_id":"0caebe22-994c-4c12-baae-be3ca4ca0d15","resolution":{"observed_at":"2026-08-06T16:12:25.220914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:24.839810Z","title":"Addressing function approx- imation error in actor-critic methods,","venue":null,"work_id":"dfbf1bc7-4c45-4692-af29-27eb944ae774","year":2018},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:23.503527Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:f7c8084ab35f39444895905d490365d10b07a69839776a567f90e9fe127237cf","observation_id":"118b655d-a303-48e7-8f0d-d9a72d622303","resolution":{"observed_at":"2026-08-06T16:12:24.860344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:24.734415Z","title":"On practical robust reinforcement learn- ing: Adjacent uncertainty set and double-agent algorithm,","venue":null,"work_id":"6e686ca4-0834-4652-b53b-4e1bf874ac70","year":2024},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:23.589348Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:470c6de2e7107f84a73e6557ef9974741476aca1916282287a36bc55a24cef6e","observation_id":"86a4c66e-dfd2-418d-b4b0-15105be77608","resolution":{"observed_at":"2026-08-06T16:12:24.789400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:24.639686Z","title":"Asymmetric least squares estima- tion and testing,","venue":null,"work_id":"4e6563b8-a137-4cdd-8cac-ac0a37a147a5","year":1987},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:23.677363Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:88c05e2be095e67ab07883afe5c9b7842fb025628daa52639b85b34fd5d63324","observation_id":"68a3d08b-25db-4d45-9d09-8edad78f5adc","resolution":{"observed_at":"2026-08-06T16:12:24.686043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-13T12:26:05.192883Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-06T16:12:23.762352Z","title":"Openai gym,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:23.762352Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:05efd0be75a2d8dc1ce68596a1a5fbb8f3e710e78afb338e82daf0760fee9136","observation_id":"f673bec6-a519-4541-a0da-7ca0b9f4f1a8","resolution":{"observed_at":"2026-08-06T16:12:23.762352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-08-13T22:24:37.672685Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-06T16:12:23.837020Z","title":"Gymnasium: A standard interface for reinforcement learning environments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:23.837020Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:af0a9404e853cae21709c91c36b513aa7223382675514844892fb5a79e91e94d","observation_id":"570b39f7-41bb-488e-9545-9eef80e40ff7","resolution":{"observed_at":"2026-08-06T16:12:23.837020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:24.500633Z","title":"Stable-baselines3: Reliable reinforcement learning implementations,","venue":null,"work_id":"ade524c4-f76b-493d-bd9e-5c9884722ad9","year":2021},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:23.904485Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:ad43ea538b398c972669cab22b01172fceb195101ec6e88cfc83f2b71b75427a","observation_id":"40a1601f-6b6a-4f5b-92da-484b355a8ca2","resolution":{"observed_at":"2026-08-06T16:12:24.550988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:24.360726Z","title":"Rl baselines3 zoo,","venue":null,"work_id":"640ecd2a-8588-46da-baa5-a4552d9f93c3","year":2020},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:23.978142Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:c70d70fdfc5a82ca8e7592522fa85b6a7569f40dd6dc60fa717d3ab7f410de63","observation_id":"3ba24771-56f0-4654-a70b-a3d01ef7d79e","resolution":{"observed_at":"2026-08-06T16:12:24.406772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:12:24.219205Z","title":"Control- ling overestimation bias with truncated mixture of continuous dis- tributional quantile critics,","venue":null,"work_id":"ca6997da-6170-472e-841e-580b791e4090","year":2020},"citing_paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:24.068352Z"},"links":{"citing_paper":"/paper/2507.14487"},"observation_digest":"sha256:7a0376564f3f3ac05047c22f9b5334ee671029182024c3747a9137513b6f67d1","observation_id":"1fc0f531-c647-4a0e-b471-844e95cc7807","resolution":{"observed_at":"2026-08-06T16:12:24.282103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.14487","last_updated":"2025-07-19T05:06:38Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T06:47:03.206174Z","submitted_at":"2025-07-19T05:06:38Z","title":"Federated Reinforcement Learning in Heterogeneous Environments"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":35},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2507.14487."}