{"as_of":"2026-08-19T20:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dabe8f79c9ab8cf2a2cf2ff2f534ad2b86bf10a6bcd4a3eca62392c340385c23","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T17:31:58.425533Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:25:50.602184Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-11T11:25:51.226584Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"cited_work":{"arxiv_id":"2502.00870","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00870","snapshot_observed_at":"2026-08-11T11:25:51.226584Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","venue":"cs.LG","work_id":"4f43a1a7-8e17-4380-b2f1-51b1d2dc85bc","year":2025},"citing_paper":{"arxiv_id":"2412.15538","last_updated":"2025-02-08T02:34:08Z","snapshot_observed_at":"2026-08-17T18:16:50.949154Z","submitted_at":"2024-12-20T03:56:31Z","title":"FedRLHF: A Convergence-Guaranteed Federated Framework for Privacy-Preserving and Personalized RLHF","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T11:25:50.602184Z"},"links":{"cited_paper":"/paper/2502.00870","citing_paper":"/paper/2412.15538"},"observation_digest":"sha256:f1ce297a980b67f88df9d2d89c90f9db0ddd69c2d722e327af0ec75d97c66ce1","observation_id":"da2cd6fa-b2b4-4fce-bd98-b31164f1695f","resolution":{"observed_at":"2026-08-11T11:25:51.232401Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.00870/citation-record","integrity":"/paper/2502.00870/integrity","json":"/paper/2502.00870/citation-record.json","paper":"/paper/2502.00870"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.103241Z","title":null,"venue":null,"work_id":"1e11dff3-cc15-4f1f-ab4a-3b29600c3f4c","year":2016},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.198799Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:5643d540ea70ec9b426988cb640a94efe03368a8225f9986f27afba0b1fe6af4","observation_id":"b97ce03b-67fe-41d4-9dfb-13b57bac94df","resolution":{"observed_at":"2026-08-09T17:31:59.106951Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.092123Z","title":null,"venue":null,"work_id":"12377847-1f77-45f2-be88-398bb2233ce6","year":2001},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.203701Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:5f482b6a7e923497467fdb0c2e1a8ba9c1a14a2da84e8e399edd57c35cc47e47","observation_id":"3c292e61-145a-4175-b212-c1cd852f5378","resolution":{"observed_at":"2026-08-09T17:31:59.095841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-13T12:26:05.192883Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-09T17:31:58.207707Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.207707Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:e02b6206215bb9e14328ebd0e33a1707c69835ccf36bf54b8f69f9e177359a3a","observation_id":"5b196c5d-158e-4335-9baa-a68c056b54f8","resolution":{"observed_at":"2026-08-09T17:31:58.207707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.081079Z","title":null,"venue":null,"work_id":"00dc0eec-d7e2-453d-9b93-90430121383f","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.212231Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:3fd7bcbf175d3cd88e69ade05ee1d16d217179dc870fd9c198eb658f365e87c2","observation_id":"d1126db9-5bab-4e55-a34e-18eafb005f13","resolution":{"observed_at":"2026-08-09T17:31:59.084621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.069752Z","title":null,"venue":null,"work_id":"100b90b5-d3ad-4b5a-a44f-9ecb39134efa","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.216363Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:990e5b86fda1925c0cc9ada2bcf4d147d5fa640b48895da4b9762bde7160dce7","observation_id":"f8741767-cb6a-4c14-9214-8b8e54b353cb","resolution":{"observed_at":"2026-08-09T17:31:59.073682Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.220259Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.220259Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:18464780150dc41e84a315c0b7cee76b3da62e0a7f9ad74a4fb615f7e20dcd13","observation_id":"dbda2a6c-cc9d-4354-9b88-2b7c4d7b8ce0","resolution":{"observed_at":"2026-08-09T17:31:58.220259Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.058092Z","title":null,"venue":null,"work_id":"ec4ec9ff-ac99-48a7-a209-ae0f22af76cb","year":2017},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.224597Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:fe50dd4a090ccafe9956cb8e68768ab21e0120b691f185c53bace1bcc0e470dc","observation_id":"34a16894-c5da-4f59-a72a-6fb9c490e4b4","resolution":{"observed_at":"2026-08-09T17:31:59.062202Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.046810Z","title":null,"venue":null,"work_id":"6dbf1ac7-98b8-4aa2-a78d-57420d8c6cd8","year":2021},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.228374Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:5674a78a79e8e85f58d8f1859bad36d5974f7d5a201bc75e38200aa688a38dcd","observation_id":"ee50c94e-15fc-4d6d-bd31-7a6056efc6f7","resolution":{"observed_at":"2026-08-09T17:31:59.050438Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.035406Z","title":null,"venue":null,"work_id":"47d9aab6-532d-4bdc-a120-37e2e4401d1f","year":2023},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.232290Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:21a2dfed4d377d7479bad6271fff4dab478ec6e1e7a052fc9829f9fbdf3200fa","observation_id":"b3bcea4b-a175-4c08-a27e-1e919fa4970d","resolution":{"observed_at":"2026-08-09T17:31:59.039210Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15538","last_updated":"2025-02-08T02:34:08Z","snapshot_observed_at":"2026-08-17T18:16:50.949154Z","submitted_at":"2024-12-20T03:56:31Z","title":"FedRLHF: A Convergence-Guaranteed Federated Framework for Privacy-Preserving and Personalized RLHF","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15538","snapshot_observed_at":"2026-08-09T17:31:58.236005Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.236005Z"},"links":{"cited_paper":"/paper/2412.15538","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:0fe0dd8aba9cde709e570c7e6999e7615cd4b9ac8809eac124f78841d9473bb2","observation_id":"41634c53-34ff-4888-8aaa-04d1f54b36d6","resolution":{"observed_at":"2026-08-09T17:31:58.236005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.023910Z","title":null,"venue":null,"work_id":"32ad1203-afad-4d27-b106-fae8e9da6cde","year":2023},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.240064Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:8576dc14006c3056507dce73d4873f2e200f17445ed217feba190e67fe3eb504","observation_id":"bd0b92a4-b859-4b77-968b-f02f0d22de33","resolution":{"observed_at":"2026-08-09T17:31:59.027642Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.012268Z","title":null,"venue":null,"work_id":"088aaa5f-5ca5-4506-8bb7-25b475f9b9f8","year":2023},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.244036Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:b8cd9673bb7bad5a7be612672520511f6ea8e59987a527c9d3b0eddf3f304970","observation_id":"bdc586ec-283d-464d-9a56-ca44d0454d97","resolution":{"observed_at":"2026-08-09T17:31:59.016436Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.247929Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.247929Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:284848a1f655e07e671c034012ae7a4bc119bf61b77a7f2cc55800630f7f92f6","observation_id":"5c85e29c-58bf-4dbf-b323-160361033203","resolution":{"observed_at":"2026-08-09T17:31:58.247929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.992560Z","title":null,"venue":null,"work_id":"d7587729-c83e-409d-98b7-b2085323ab55","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.251945Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:def68a0d86e80d60af644bb8fb31a212c1489d123a45fc45fa5cfcd5b78f764d","observation_id":"3a9d9b2c-25fd-4df8-8435-93219d405ea3","resolution":{"observed_at":"2026-08-09T17:31:58.996852Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.255711Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.255711Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:9f101dbaf48eb97111449529f59582fb139e49a7fd8b7bf2435eff389ba45425","observation_id":"e3e7e635-0428-4e4d-8746-e9dd90600dbe","resolution":{"observed_at":"2026-08-09T17:31:58.255711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-09T17:31:58.259556Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.259556Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:b0c00560a043fa31d3365572e201eae68310454ef104f50d568989a0ef5456f2","observation_id":"61df8393-0644-4ee0-9568-a5f9d9e14c17","resolution":{"observed_at":"2026-08-09T17:31:58.259556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.974194Z","title":null,"venue":null,"work_id":"56a9acd0-4797-4445-ad4a-4a9492f11f49","year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.263504Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:f8e7b0d9a2919cd2e79a8d0d3e7d1fdf7a7c11adf426103b0b0364c0c137a63f","observation_id":"13823ccd-a14b-4244-968b-fd05fa4b85fd","resolution":{"observed_at":"2026-08-09T17:31:58.977841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.962977Z","title":null,"venue":null,"work_id":"c76d57b4-f58b-47f2-afff-fa5da53d56d6","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.267014Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:1d51db56e4d2371dec676a09a0e301424ec72841fe215d595b644ce50ee15aa1","observation_id":"4dca1744-71f3-48fc-a042-2a1b211f3ebf","resolution":{"observed_at":"2026-08-09T17:31:58.966881Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.951571Z","title":null,"venue":null,"work_id":"46a1a4bb-0402-4148-8ccb-be48443508df","year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.270730Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:26dcc457ee7ca07d9f8e7bbd8d1142b0ac85d3424027a649e54f94c3901ac7bd","observation_id":"fd76266e-a387-47c3-8bbd-2d876ec7c242","resolution":{"observed_at":"2026-08-09T17:31:58.955546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.939847Z","title":null,"venue":null,"work_id":"13ae51f8-6b1c-492f-8084-6fc4b1e8641e","year":null},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.274244Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:0db1cd8d68a146730853d6c294c4898d08e9065fb362eee65b2f0e74365e7850","observation_id":"9a01fb5a-bed3-4196-ade2-241dba36d7be","resolution":{"observed_at":"2026-08-09T17:31:58.943874Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.916975Z","title":null,"venue":null,"work_id":"2a662bdd-b1a5-409e-8556-08cb3d3a405c","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.281802Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:680e886071a02f4506fb65263ead621af0e6e6f37ef4262bc13f8d9f64cdaa0d","observation_id":"60e0a0d9-24fa-46c5-8126-8850bc6f954f","resolution":{"observed_at":"2026-08-09T17:31:58.920768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-09T17:31:58.285592Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.285592Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:83f01e8cb8a724e19c46e3d8b50883a0f0ed5540537774896489ff935487f9ad","observation_id":"00317cb7-3fef-4b8b-bcc2-be5badf2dba8","resolution":{"observed_at":"2026-08-09T17:31:58.285592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03581","last_updated":"2019-10-08T18:00:00Z","snapshot_observed_at":"2026-08-14T20:20:16.604226Z","submitted_at":"2019-10-08T18:00:00Z","title":"FedMD: Heterogenous Federated Learning via Model Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03581","snapshot_observed_at":"2026-08-09T17:31:58.289813Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.289813Z"},"links":{"cited_paper":"/paper/1910.03581","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:fce570abcd992392dd9bcf167cdfbad7a767bf90cd3e6bba9a4221ba54f79848","observation_id":"1ab93efb-5daf-4d5e-8994-8bdbe05014a5","resolution":{"observed_at":"2026-08-09T17:31:58.289813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.905004Z","title":null,"venue":null,"work_id":"2b83e34d-0c4a-480f-8572-837c3cef4cbf","year":2020},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.294066Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:fd1ba4cc4e62726d67c689cc91adfaee494c3ebe828d88eff907b70c836bce8e","observation_id":"2ad867f9-897f-45ff-ab22-71b6d3efdf4f","resolution":{"observed_at":"2026-08-09T17:31:58.909459Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.892234Z","title":null,"venue":null,"work_id":"1f596f48-5a3d-4fa8-afcc-d12868aeb59d","year":2016},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.297866Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:069e91ad4197add5b667d72303b7a1b7ed15f784dea798d7260c5fdfc66e810c","observation_id":"1278d98b-f9e8-4934-b187-893cefe50b6c","resolution":{"observed_at":"2026-08-09T17:31:58.896788Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.880201Z","title":null,"venue":null,"work_id":"70c1a8ff-5eb0-4194-9047-85bc4faa6199","year":2023},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.301366Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:c889d4a3ebfe98dcf11c9032bb1af692ac2ea1388befb1e98e75c82f708da668","observation_id":"930d8d1d-e56c-46f5-abac-663877e78352","resolution":{"observed_at":"2026-08-09T17:31:58.884381Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20156","last_updated":"2024-04-16T20:31:16Z","snapshot_observed_at":"2026-08-16T14:05:12.590995Z","submitted_at":"2024-03-29T13:05:59Z","title":"CAESAR: Enhancing Federated RL in Heterogeneous MDPs through Convergence-Aware Sampling with Screening","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20156","snapshot_observed_at":"2026-08-09T17:31:58.304920Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.304920Z"},"links":{"cited_paper":"/paper/2403.20156","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:ba9317b18646284784d50711d8efdef9c058932f8c0579597f4c6dc029d154cd","observation_id":"c3f16ce6-7cdd-4983-9480-af081099980b","resolution":{"observed_at":"2026-08-09T17:31:58.304920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.868435Z","title":null,"venue":null,"work_id":"927cd1b3-8eba-4cb5-95b2-60413bbc0cce","year":2017},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.309157Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:746b7e51989e2cc453118cf46fe0360ec7db30c8d822189fd24a1136e5f495f1","observation_id":"eaec9fa6-f2e6-4ad2-a42a-0b418292b5fb","resolution":{"observed_at":"2026-08-09T17:31:58.872226Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.01783","last_updated":"2016-06-16T16:38:45Z","snapshot_observed_at":"2026-08-17T11:02:06.117758Z","submitted_at":"2016-02-04T18:38:41Z","title":"Asynchronous Methods for Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.01783","snapshot_observed_at":"2026-08-09T17:31:58.313102Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.313102Z"},"links":{"cited_paper":"/paper/1602.01783","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:25fe31d6440006776a7275d05bba8929c6f51bd1207001b466ff7ed3e138f18b","observation_id":"5a10a953-c197-4bd2-8f65-696442f513e3","resolution":{"observed_at":"2026-08-09T17:31:58.313102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.855504Z","title":null,"venue":null,"work_id":"4b7431d4-8167-44c0-a04a-e89263159d95","year":null},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.317445Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:d3e7894cdb99e5ee66adac59bb92907682bd70b6f1fb74eb2b5cff4f5d1e8e27","observation_id":"19aa02b9-d3c8-4f92-8ca4-e1a2c21c002b","resolution":{"observed_at":"2026-08-09T17:31:58.859464Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.830493Z","title":null,"venue":null,"work_id":"ed2703d8-3569-433d-bba7-64ca1bf9c57d","year":2018},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.325496Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:eeaa07f26f934a4cd59b4f3ad74290bd357685345075edffa331da30caed9cd5","observation_id":"fdb6345f-0262-46ba-b648-223abc158f38","resolution":{"observed_at":"2026-08-09T17:31:58.834122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.818974Z","title":null,"venue":null,"work_id":"27e823e2-c2f6-4f0a-aea7-6593a72260a7","year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.329478Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:999b2cdc2ae832a83d108519c811d7ad74d45cc113cd923b576dec7bdcfaa6fb","observation_id":"889744e9-7b95-4024-887d-88b1fdd60615","resolution":{"observed_at":"2026-08-09T17:31:58.822700Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.806843Z","title":"Reddi, Ahmed Hefny, Suvrit Sra, Barnabas Poczos, and Alex Smola","venue":null,"work_id":"5b296649-fb0d-481e-9e35-d3e930a61fde","year":null},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.333085Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:64ec30bebe432105a136f06af547b6df56230e939148a998af1bef282a761909","observation_id":"6e8b90f3-cd7c-4714-afbf-e9ab320c1755","resolution":{"observed_at":"2026-08-09T17:31:58.811112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06295","last_updated":"2016-01-07T18:43:03Z","snapshot_observed_at":"2026-08-18T00:03:21.764059Z","submitted_at":"2015-11-19T18:38:47Z","title":"Policy Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06295","snapshot_observed_at":"2026-08-09T17:31:58.340982Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.340982Z"},"links":{"cited_paper":"/paper/1511.06295","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:c4c6ec272dc836cb862bfbaff3c5b13e4c4ca063848538c80e624b4f50f8950d","observation_id":"cdec8aac-6a9c-45c7-acff-63564435e191","resolution":{"observed_at":"2026-08-09T17:31:58.340982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.779284Z","title":null,"venue":null,"work_id":"5484f69a-dc1a-4077-be31-7cc30643dab4","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.344924Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:5ddffa0bd6b503d7f604ea1112078ec15f76d7749634ad0e65dc5418ca691876","observation_id":"bc4984e2-774d-4f92-af02-db4aaa69c518","resolution":{"observed_at":"2026-08-09T17:31:58.783624Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.348564Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.348564Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:1833541c9199eeacaf60f341824032608b7a9c2847aabdc2ff02724af0f4e0ce","observation_id":"7ca1a4f2-933a-4520-999e-01a8a60d669e","resolution":{"observed_at":"2026-08-09T17:31:58.348564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.356450Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.356450Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:b3b6643461bd93afa797f0fc1515d5c8f858f19b112e55aac40215dbe87348ed","observation_id":"01c854df-64a4-4ed6-bca9-cddebac40343","resolution":{"observed_at":"2026-08-09T17:31:58.356450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.738694Z","title":null,"venue":null,"work_id":"a2b0da1e-0e96-4fad-8c0d-7c6461a0b5c5","year":2014},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.363784Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:4ca6a8891a45b7afd7d0883c5a573d2a43a023cc1da67fde7c8fa4bfb7c4e402","observation_id":"7be6b9fc-cf7d-4414-9482-3ff91d2e6734","resolution":{"observed_at":"2026-08-09T17:31:58.742943Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.727251Z","title":null,"venue":null,"work_id":"81ddcc38-f16f-4f7d-9c91-408ceef65d45","year":2021},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.367651Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:a15cd1e2a779ed43d074bd8751bc68238ec130068868d111e3244f3e32634c42","observation_id":"81768005-7d30-4ced-bbe4-2effeb50ba4e","resolution":{"observed_at":"2026-08-09T17:31:58.731072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.371544Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.371544Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:065b8b18e1407a6de4831b1a7a5d983958216dc8bf4595045092e9bb7b09cc0c","observation_id":"266406d9-3f4a-4abd-99ea-572d6b5a6aaa","resolution":{"observed_at":"2026-08-09T17:31:58.371544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.708147Z","title":null,"venue":null,"work_id":"e39ac2a7-6e56-42e7-85b0-74afc802961e","year":2020},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.375244Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:b3abee608e05f47ae8c7c6a5ba96ab5565209ac4e3447f48e070d5598f08c0db","observation_id":"49005417-1d1c-4439-a2c7-67748cca9e8c","resolution":{"observed_at":"2026-08-09T17:31:58.711850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.696536Z","title":null,"venue":null,"work_id":"5f149af8-26a1-4bd9-8040-995ad877034d","year":2019},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.378862Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:d9ed86b6b1fcc8e3901cf1663c0555605d708762b7c499c84a4f8359b3679dbc","observation_id":"7551c5ef-83e6-42d5-b1a6-864f82309463","resolution":{"observed_at":"2026-08-09T17:31:58.700392Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.683128Z","title":null,"venue":null,"work_id":"01a6b624-2f08-4068-8b6d-59dec002eb38","year":1992},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.386444Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:4800b4f812d9cfa5669fb65434885a4c227b17b182cab382ef0b109c2f975f5a","observation_id":"0956b8bc-e9ef-41c0-bb10-f4b93860eb6b","resolution":{"observed_at":"2026-08-09T17:31:58.688160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.671679Z","title":null,"venue":null,"work_id":"d60c4a24-b67c-42bf-85d9-c4fb2d547a88","year":2023},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.390348Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:4769af865906fc5a4d35442aacd1308900759993a2775abc180983e71a5d9727","observation_id":"3963498e-c196-47c3-8a67-60dd524647d7","resolution":{"observed_at":"2026-08-09T17:31:58.675407Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.660642Z","title":null,"venue":null,"work_id":"d98114c6-fb71-460d-8354-0f880bb24215","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.394015Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:5e6def049d290f0047cf6fe8bd9574fdcb346cb51056d93aed07d3e631cce64e","observation_id":"75c89570-a232-405c-b6a4-8878bf499542","resolution":{"observed_at":"2026-08-09T17:31:58.664220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.649485Z","title":null,"venue":null,"work_id":"e67ed5b9-72cf-4dc0-859d-a69874800bd8","year":2020},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.398437Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:fae463e9552b308247b088075c2c231390dd83ed90a261eff33c740bf6c2f58b","observation_id":"d8f9c2d6-318c-4f18-a73c-ba3101503936","resolution":{"observed_at":"2026-08-09T17:31:58.653345Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.638173Z","title":null,"venue":null,"work_id":"9aa9d7c6-4f7e-49aa-8b11-d910b658ee1f","year":2023},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.402132Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:b1bd9caed8cde2c84c8fe970164a7937ed5923831763b08fc579ca2682e50916","observation_id":"fa793a0e-54cc-4875-a5f7-a1fec141cc9a","resolution":{"observed_at":"2026-08-09T17:31:58.642045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.626084Z","title":null,"venue":null,"work_id":"a86436cf-92df-477d-b503-015d7092533e","year":2018},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.406148Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:249e9d8eb3016c0e00daafe01d434d5d24e18b8b521dc94d31e38b2613f362be","observation_id":"21ae6a97-5327-49f1-9898-c68097ac6f19","resolution":{"observed_at":"2026-08-09T17:31:58.630283Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.613025Z","title":"Gower, and Alessandro Lazaric","venue":null,"work_id":"e5d472ac-61ab-4de5-9a67-6bb9ba111d13","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.409970Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:54734aa403bc3dd402d92812d3ea58f98383fe00eff15c56b0df080f8292f435","observation_id":"7f27f11f-b3c9-48c0-9453-b2c8982c0f08","resolution":{"observed_at":"2026-08-09T17:31:58.617086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.600740Z","title":null,"venue":null,"work_id":"6a20bbc1-077e-4c42-b9e8-b97eb012607a","year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.413743Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:2847267dffb412bb543d0bd21d00ed49929e87c8b1cfb6e06ac9684c70f4b285","observation_id":"ce916336-016b-46d5-a3b0-1fae83a39697","resolution":{"observed_at":"2026-08-09T17:31:58.604904Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.589297Z","title":null,"venue":null,"work_id":"c8fd8fae-6101-4b6b-98d6-e3557090b291","year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.417870Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:f87bb114eb44a3b939aa51bbc04d5e79f96dcf8f078f2f0fea73624ba9d2bbf3","observation_id":"77ef1d6d-9688-4ae1-9b54-b564a2548ef8","resolution":{"observed_at":"2026-08-09T17:31:58.593116Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.577893Z","title":null,"venue":null,"work_id":"35d9a7d5-38d6-47b0-af54-392cd0c7d695","year":2021},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.421599Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:a887b75523a652214094ce45754bea9db1189f7c352fd5eb926f509576940ad0","observation_id":"47d57751-ed93-4d64-a834-6a703a02d40c","resolution":{"observed_at":"2026-08-09T17:31:58.581699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.564856Z","title":"∑︁ 𝑠,𝑎 𝜋𝜃(𝑎|𝑠) log 𝜋𝜃(𝑎|𝑠) 𝜋𝑔𝑙𝑜𝑏𝑎𝑙(𝑎|𝑠) !# = ∑︁ 𝑠,𝑎","venue":null,"work_id":"30bcbfef-8bd9-4a88-887e-22f177563112","year":2000},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.425533Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:fdf83d931c5d7609d2d2b81c57080e44b3a028aa9991d867dfce9351bc90b78a","observation_id":"0e91414d-b1b1-49f0-a94a-dfc29e52f2d5","resolution":{"observed_at":"2026-08-09T17:31:58.569969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.757829Z","title":"In International Conference on Machine Learning, Vol","venue":null,"work_id":"be129a9f-0b90-4176-8616-68a72e2e26cf","year":null},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.352390Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:e2a4047af90e9c60a333e406743aa999a7149a34944f699aae682a7ac2a2c5f7","observation_id":"6fb14700-28d9-4a4d-9ca0-f0b377859a55","resolution":{"observed_at":"2026-08-09T17:31:58.762795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.791888Z","title":"In Interna- tional Conference on Machine Learning , Vol","venue":null,"work_id":"b2f70989-e860-4c6a-a993-85284ed00c7f","year":null},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.336898Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:fc41f2de636be3f08604b13a49eb448bc7663c7491a391f8c8bdd35e188b867c","observation_id":"cc6b1b71-7592-492f-8203-8bb9d815f3e4","resolution":{"observed_at":"2026-08-09T17:31:58.796382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-09T17:31:58.360002Z","title":"arXiv preprint arXiv:1707.06347 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.360002Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:3bb6537550f7e703f0640e9b090bf706cc5f81417bcae0df95e70f88df9a62b0","observation_id":"0aadf7e7-0560-4af0-a151-3d09739a8a44","resolution":{"observed_at":"2026-08-09T17:31:58.360002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.842918Z","title":"In AAMAS 2019, Vol","venue":null,"work_id":"cf4cf760-4000-4b95-b610-764a4c24da03","year":2019},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.321568Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:40613139babc232c8ae2436c60bdf91ce47ff0ed1b577c2ea07670241bd627f8","observation_id":"92abb098-efad-426e-bbe7-1f40c7896dc2","resolution":{"observed_at":"2026-08-09T17:31:58.846851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.929037Z","title":"Nature Machine Intelligence 4, 12 (2022), 1077–1087","venue":null,"work_id":"b90c5285-a328-4e56-8961-c0a5dc6a010f","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.278056Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:022123354d1e07ad115d25c0da88afba5a60ecaa84b3e02062007661ca63d17c","observation_id":"8cc9f15d-0834-4581-b28b-25c4dff52a8c","resolution":{"observed_at":"2026-08-09T17:31:58.932760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T20:21:15.370256Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 1 inbound Pith citation observation for arXiv:2502.00870."}