{"as_of":"2026-08-12T15:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e411613e2978259dd6a50ec30e389035be6b7ffd1dd1b03b536b27026ac21a92","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T18:54:19.227490Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.10938/citation-record","integrity":"/paper/2501.10938/integrity","json":"/paper/2501.10938/citation-record.json","paper":"/paper/2501.10938"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:20.089109Z","title":"A reinforcement learning method for human-robot collaboration in assembly tasks,","venue":null,"work_id":"99a37659-5a0f-47a8-bb59-f22783f62251","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:18.975964Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:b9b8cacecd9fb21cb515a7f708891954572140fd3e2dbdba03e209879ff94452","observation_id":"1b36eabe-b713-473a-b152-9f742ef26701","resolution":{"observed_at":"2026-08-10T18:54:20.094013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:20.073000Z","title":"IoT sensor selection for target localization: A reinforcement learning based approach,","venue":null,"work_id":"e61a5be3-7823-4e9c-a048-dac622f16e63","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:18.981313Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:9c34da36b8a45a1966591e3e38e2654653cb6caa4e26644c9aff9ce305f2d030","observation_id":"04fed452-9fe5-4dad-94f0-a0f2c4ca2c5e","resolution":{"observed_at":"2026-08-10T18:54:20.078359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:20.057302Z","title":"Self- supervised online and light-weight anomaly and event detection for iot devices,","venue":null,"work_id":"827df8bc-cfc0-4f01-88de-99993c9afc29","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:18.986492Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:8a3700c14e08ef31497b8f48808b55d8d61a918967587e8acb451455bacc079f","observation_id":"f8d50044-7601-4622-aa79-c0bc0c864ca1","resolution":{"observed_at":"2026-08-10T18:54:20.062564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:18.991666Z","title":"Mastering the game of go without human knowledge,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:18.991666Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:297b5df7a453a326a588fdc6c880a91a7e97670d6038be2b1fabe942e5e74253","observation_id":"e1761ab0-e548-4a9a-a317-ffc6a7f8f1c5","resolution":{"observed_at":"2026-08-10T18:54:18.991666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06680","last_updated":"2019-12-13T19:56:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-12-13T19:56:40Z","title":"Dota 2 with Large Scale Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06680","snapshot_observed_at":"2026-08-10T18:54:18.997231Z","title":"Dota 2 with large scale deep reinforcement learning,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:18.997231Z"},"links":{"cited_paper":"/paper/1912.06680","citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:6eb7837cd2562bb65238e533f256b9d2d6265aafdce1070907413b8b411c81c1","observation_id":"713fb8e3-3f70-4bf2-b1b8-f6436955e3a9","resolution":{"observed_at":"2026-08-10T18:54:18.997231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.002789Z","title":"Multi-agent deep reinforcement learning to manage connected autonomous vehicles at tomorrow’s inter- sections,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.002789Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:0b7e7b1c6353f5a6b9b4af4297bd1c498903146603ff36da0c461f8f55af2c1f","observation_id":"4f40ba40-dca8-41b5-a0ac-01049c1bd02a","resolution":{"observed_at":"2026-08-10T18:54:19.002789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.008107Z","title":"Target lo- calization using multi-agent deep reinforcement learning with proximal policy optimization,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.008107Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:e1108cdf8170beda166d147a0256eed082d0010cdb09f0c35416af224b4582c5","observation_id":"9f1b34a7-47c5-42e7-9aaa-47c1c1496ed4","resolution":{"observed_at":"2026-08-10T18:54:19.008107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:20.011067Z","title":"Fault- tolerant federated reinforcement learning with theoretical guarantee,","venue":null,"work_id":"afd458f1-1d62-4ab5-b2a2-e5fe9d5f82b6","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.012763Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:6d7429f6aff7e4c91d0a2a56eff12c5a45a586579a7dde33fb67978cb88ea394","observation_id":"b9929436-c00a-4b71-9e0e-eebf61745336","resolution":{"observed_at":"2026-08-10T18:54:20.016473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.994179Z","title":"Resource allocation in iot edge computing via concurrent federated reinforcement learning,","venue":null,"work_id":"17f53a3e-530d-46de-9813-dce4cc649405","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.017471Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:097a278957360269827fecdbc2f819b2a30ad02c43ee881319f8d0b83cb8ad18","observation_id":"bee9843b-de19-4629-bfa3-14220e450d86","resolution":{"observed_at":"2026-08-10T18:54:19.999842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.976992Z","title":"Federated reinforcement learn- ing for fast personalization,","venue":null,"work_id":"933276fc-3787-43dc-9741-21034442ee59","year":2019},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.022139Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:204e14dcb3d937a62056330e626e6f0d70a860e15c107c00543b5783f4bd9c22","observation_id":"1c3d613e-ffa2-4084-b849-03d26e0fd8bb","resolution":{"observed_at":"2026-08-10T18:54:19.982037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.960710Z","title":"Deep reinforcement learning for multiagent systems: A review of challenges, solutions, and applications,","venue":null,"work_id":"198fd052-4842-490d-a1cf-e90ff2ff0441","year":2020},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.027684Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:ce5c70aa6ae6faec807b5715837ef89d1aec2ef46bf0ed530e76eb03636e7208","observation_id":"5f636dd2-1368-46e4-8a63-a2302e8f6942","resolution":{"observed_at":"2026-08-10T18:54:19.965846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.943700Z","title":"Learning to utilize shaping rewards: A new approach of reward shaping,","venue":null,"work_id":"3a34a5ce-832a-4a30-a03a-d27f71e65b10","year":2020},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.032289Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:9daca81da7098cf698234d07d1d839ca22d43b014e9f92aa9a263425e73592b2","observation_id":"9f09f157-6264-44c4-b2c0-d4272e4a8f12","resolution":{"observed_at":"2026-08-10T18:54:19.948821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.927138Z","title":"Graph convolutional recurrent networks for reward shaping in reinforcement learning,","venue":null,"work_id":"0e530ecd-6612-4ac5-ad87-a2eec894083f","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.037706Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:dc5887488b92d0727026e6bb5b0bcfae8f2b6c93b054c6f61ba95516f16f6c7a","observation_id":"abcf40a3-55e0-45a8-ae1d-8d96b4a48e39","resolution":{"observed_at":"2026-08-10T18:54:19.932315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16956","last_updated":"2022-10-30T21:28:22Z","snapshot_observed_at":"2026-08-10T12:58:13.282641Z","submitted_at":"2022-10-30T21:28:22Z","title":"Reward Shaping Using Convolutional Neural Network","version":1},"cited_work":{"arxiv_id":"2210.16956","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.16956","snapshot_observed_at":"2026-08-10T18:54:19.333581Z","title":"Reward Shaping Using Convolutional Neural Network","venue":"cs.AI","work_id":"932aef08-9d62-4203-ba1f-d09524b704b5","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.042501Z"},"links":{"cited_paper":"/paper/2210.16956","citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:9de410040bb90082ebcd933f854671d18657dd504117348978b57d10c05d06c0","observation_id":"0dacecef-2c40-46aa-9e6f-94008007921d","resolution":{"observed_at":"2026-08-10T18:54:19.341068Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.909910Z","title":"Federated learning for internet of things: A comprehensive survey,","venue":null,"work_id":"6d9939b8-5e80-4852-8d86-bce4e04d3a52","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.047831Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:564ce2a3fbcf7eddbf1b27cc854575965d236a9a09b176bd3cd0e03da67e0b65","observation_id":"87332c17-9d06-4394-ac23-fdb50d036692","resolution":{"observed_at":"2026-08-10T18:54:19.915409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.053345Z","title":"Knowledge distillation: A survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.053345Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:d9668dcd6594cc5cb75caf2e9599703a93701c4e79834c3e8082e5b9fcbc49fb","observation_id":"6cee09f1-8dd1-4a7b-afc3-80657def30f2","resolution":{"observed_at":"2026-08-10T18:54:19.053345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.11887","last_updated":"2021-10-24T19:02:03Z","snapshot_observed_at":"2026-07-06T11:41:48.795143Z","submitted_at":"2021-08-26T16:22:49Z","title":"Federated Reinforcement Learning: Techniques, Applications, and Open Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.11887","snapshot_observed_at":"2026-08-10T18:54:19.058241Z","title":"Federated reinforcement learning: Techniques, applications, and open challenges,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.058241Z"},"links":{"cited_paper":"/paper/2108.11887","citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:ace86c6697dbe8db3875c798a2be80670ce3b955c554a5c9ed229e5dc449b381","observation_id":"2e3eef1e-6bd8-49b4-add6-b890f1b7c7b4","resolution":{"observed_at":"2026-08-10T18:54:19.058241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.883921Z","title":"Overcoming exploration in reinforcement learning with demonstrations,","venue":null,"work_id":"b7d4219b-b1b7-4355-83b9-3936c3e3c875","year":2018},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.063277Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:59f91b05219a4f75cc85e4e397d613eabae8453fceb7cab3aec11aca391c0aec","observation_id":"2e819415-e1df-4440-ac19-07042cd00a5d","resolution":{"observed_at":"2026-08-10T18:54:19.889012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.08817","last_updated":"2018-10-08T13:38:52Z","snapshot_observed_at":"2026-08-10T07:54:23.821978Z","submitted_at":"2017-07-27T11:16:53Z","title":"Leveraging Demonstrations for Deep Reinforcement Learning on Robotics Problems with Sparse Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.08817","snapshot_observed_at":"2026-08-10T18:54:19.067832Z","title":"Leveraging demonstrations for deep reinforcement learning on robotics problems with sparse rewards,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.067832Z"},"links":{"cited_paper":"/paper/1707.08817","citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:5c6c60ccaef5d933fd4551029af7523828b4a07df4c8b7b62324b73fbd27c6e3","observation_id":"49ffafec-7dd3-4c35-9776-5e0d80eaf403","resolution":{"observed_at":"2026-08-10T18:54:19.067832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.072667Z","title":"Federated learning meets blockchain in edge computing: Opportunities and challenges,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.072667Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:df6bab75d5d62b13e0ba08eacc18d3f20cceeb7bd0e0656f014179ebb746bb63","observation_id":"75b54225-ec3d-46e0-9e0f-5d7eeafecbf6","resolution":{"observed_at":"2026-08-10T18:54:19.072667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.856456Z","title":"A context-aware blockchain-based crowdsourcing framework: Open challenges and op- portunities,","venue":null,"work_id":"52b871a0-3757-4127-9d39-431ba153e91d","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.077521Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:e58e360051222932a86e7bc9219416f84a3581077c79f7e1bb43ce2b8b3c5afa","observation_id":"64cc76fc-eb81-4d71-9092-47e6931f6960","resolution":{"observed_at":"2026-08-10T18:54:19.861715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.838801Z","title":"Federated multiagent actor– critic learning for age sensitive mobile-edge computing,","venue":null,"work_id":"ad84c4bb-7884-4b66-9e62-75aa7d2c4b86","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.082304Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:f4d5ef97f3ddef9d9681ec849c3d12d33afc642de7cf64316e87432523cb032b","observation_id":"89093bfd-5ab0-4232-b90a-2bb2cdfb7240","resolution":{"observed_at":"2026-08-10T18:54:19.845145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.087158Z","title":"In-edge ai: Intelligentizing mobile edge computing, caching and communication by federated learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.087158Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:1be56b861d39d1b32782a63a821a27cf6b7bb148ee19e6beb16cf9af06417cd3","observation_id":"721ced6c-738d-40fd-a907-d40473d8754c","resolution":{"observed_at":"2026-08-10T18:54:19.087158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.809307Z","title":"When deep rein- forcement learning meets federated learning: Intelligent multitimescale resource management for multiaccess edge computing in 5g ultradense network,","venue":null,"work_id":"317f00fa-3ff7-4f81-820f-e948ba1776e0","year":2020},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.091648Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:32f7e81a1861335d3ccc0ed203f8611b145f3665805bc477ae0c4b7067f974d5","observation_id":"84603e51-9e1d-451a-883e-0051d11be0f0","resolution":{"observed_at":"2026-08-10T18:54:19.815015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.096204Z","title":"Lifelong federated reinforcement learn- ing: a learning architecture for navigation in cloud robotic systems,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.096204Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:abda6297e9e7489c5d2a8275fcabf7d9b4d6db7c2837f809996748cfa645477a","observation_id":"333c33f0-e8be-4544-a456-6170a51ef34f","resolution":{"observed_at":"2026-08-10T18:54:19.096204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.780204Z","title":"Federated transfer reinforcement learning for autonomous driving,","venue":null,"work_id":"f8bb0848-77f3-4188-8161-76e8e7d68fda","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.100611Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:a156dd503fa588e99e50106e556a9dda01c9191f32ac2d3d603049dae4c425bb","observation_id":"01bae6c8-747f-4b10-a295-7b787fe6a43a","resolution":{"observed_at":"2026-08-10T18:54:19.785513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.764472Z","title":"Double Q-learning for radiation source detection,","venue":null,"work_id":"a14faaa4-0ea2-4f71-9071-8493948be16c","year":2019},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.105106Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:2dd5599e7fbc0735f1c1c31451349ed56bb333d0848efd75e56c10a1938b13de","observation_id":"5f9261eb-37b4-4adc-8709-4997df232c40","resolution":{"observed_at":"2026-08-10T18:54:19.769754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.748158Z","title":"Multi- agent deep reinforcement learning with demonstration cloning for target localization,","venue":null,"work_id":"b430235d-65a7-4f54-916e-a52c7351d309","year":2023},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.109500Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:ffb3eaed958b656fce4124c75dca34d1c780184ea43b9cf6310e00b2cbdfaf18","observation_id":"a57a4cdc-d343-48e2-98e7-ce220606d3e4","resolution":{"observed_at":"2026-08-10T18:54:19.753153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.732120Z","title":"Emergent tool use from multi-agent autocurricula,","venue":null,"work_id":"c8050306-58a7-4e45-b169-b664b82df924","year":2020},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.114251Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:3bee27d1f88fc1a2627eed234198c141b1ef997bbd0ffdaeeb7f5b5aed4a06ce","observation_id":"106687d1-a1a6-48e3-b236-76bf925afb16","resolution":{"observed_at":"2026-08-10T18:54:19.737171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.715842Z","title":"Principled reward shaping for rein- forcement learning via lyapunov stability theory,","venue":null,"work_id":"b82c34aa-3c10-49b4-9f1d-4bebf0e4d68b","year":2020},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.119798Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:14a4597f7e428161295201bfcbc5e265bd4cfadc71cb639fae5356a86ef88b6d","observation_id":"ad1434d7-786b-4588-bd38-cc1b79844032","resolution":{"observed_at":"2026-08-10T18:54:19.721438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.699635Z","title":"Primal: Pathfinding via reinforcement and imitation multi- agent learning,","venue":null,"work_id":"f65f253e-0a6a-46da-aab4-166e906b251b","year":2019},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.124284Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:8766711fd16a3b409c91150dd22bbe4b0400aa8f3fbe066f152a574fd3834389","observation_id":"9f12947d-118e-4b60-8314-400a3dccea29","resolution":{"observed_at":"2026-08-10T18:54:19.705047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.683410Z","title":"Primal 2: Pathfind- ing via reinforcement and imitation multi-agent learning-lifelong,","venue":null,"work_id":"b05e594b-d2e2-462f-b15e-804b13770ee7","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.128770Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:fae54a9ea16bf5d66ba2485644e8f97c9c333669e1eb1decd41f0a7663fd35c4","observation_id":"17214677-742f-45fb-a36b-97c2d5d9b664","resolution":{"observed_at":"2026-08-10T18:54:19.688654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.661566Z","title":"Multi-agent deep reinforcement learning: a survey,","venue":null,"work_id":"ff8485b3-9f1d-40d1-a008-b5f8d5419ec7","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.133139Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:0f08b1add73ce2041a3eda16c2b71c6308f39d75d05145fdcb0e06d8eaf71713","observation_id":"bf3725d7-bf9a-4a3a-8ed2-a6e2c2a03077","resolution":{"observed_at":"2026-08-10T18:54:19.667066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-10T18:54:19.137689Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.137689Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:d15d298c18f776659387a28f6cd4ece57c3c37b76941fded9bd394fff112bc6e","observation_id":"8fb34b76-d77f-4721-89c3-69fa944ab3c7","resolution":{"observed_at":"2026-08-10T18:54:19.137689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.645037Z","title":"High- dimensional continuous control using generalized advantage estimation,","venue":null,"work_id":"a6d22013-23f6-4f3e-9104-1f44d12f871c","year":2016},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.142508Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:17e8b501cb412fc200e1f5ea0517373ad6b7fa586559e478fe1fc43c53d3c212","observation_id":"6afa10c5-0bca-47bc-abc2-05b9aa6e7d47","resolution":{"observed_at":"2026-08-10T18:54:19.650794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.629390Z","title":"Roulette-wheel selection via stochastic acceptance,","venue":null,"work_id":"156ccc00-ea34-4e62-904d-0f281d4a07a7","year":2012},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.147059Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:578efde9fc9a70c2d096c63690b3cb10228db2ad3f26b9d1b94958ae41015c11","observation_id":"203277c9-6b80-4c61-8689-633d8481f284","resolution":{"observed_at":"2026-08-10T18:54:19.634122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.614208Z","title":"Influence-and interest- based worker recruitment in crowdsourcing using online social net- works,","venue":null,"work_id":"bb3bed79-7131-411e-b70b-10df584ab1bf","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.151682Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:ca192e31d02d15c7bf6cce910a48774904508c4e859e725d7c8ce01aab1ab23b","observation_id":"a0e0f091-cc78-46fa-95dc-93724b49187d","resolution":{"observed_at":"2026-08-10T18:54:19.619133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.598769Z","title":"On- chain behavior prediction machine learning model for blockchain-based 14 crowdsourcing,","venue":null,"work_id":"cff89014-9517-4970-8cdd-3994d756167b","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.156708Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:a2a9b47a918b20543fcf3d1735b6290a89533276f5981daa8ea2423215c0109d","observation_id":"7ef7c5fe-5936-4faa-9999-a6c98522c20c","resolution":{"observed_at":"2026-08-10T18:54:19.603783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1407.3561","last_updated":"2014-07-14T08:31:05Z","snapshot_observed_at":"2026-07-06T03:48:55.296019Z","submitted_at":"2014-07-14T08:31:05Z","title":"IPFS - Content Addressed, Versioned, P2P File System","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1407.3561","snapshot_observed_at":"2026-08-10T18:54:19.161376Z","title":"Ipfs-content addressed, versioned, p2p file system,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.161376Z"},"links":{"cited_paper":"/paper/1407.3561","citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:67d5bc0eb2c1f2f5e89af40f20aac71203d8f8df51c3cb4a0b806eb966f9f36f","observation_id":"25a3a1ec-5c9b-4d84-ace9-077da33274b5","resolution":{"observed_at":"2026-08-10T18:54:19.161376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.582794Z","title":"An optimization and auction-based incentive mechanism to maximize social welfare for mobile crowdsourcing,","venue":null,"work_id":"71e329aa-20b2-4f3d-9806-da539fc888d7","year":2019},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.166316Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:2c0a084eb301b3faa2d20289f4f1bb6c0a4b11a4bf4a22902cd72b196a75a96e","observation_id":"3dac2287-c7b9-48ba-b0a5-2ae5018f6a58","resolution":{"observed_at":"2026-08-10T18:54:19.587956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.567595Z","title":"A worker-selection incentive mechanism for optimizing platform-centric mobile crowdsourcing sys- tems,","venue":null,"work_id":"73954467-ccbc-4de5-88d0-ce92821db227","year":2020},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.170880Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:056a412808ce42061475ec53e569b8e68990e2b44d21d3f21fb646c1025c0624","observation_id":"dcf82a82-0968-4408-89b4-951a9d354ad9","resolution":{"observed_at":"2026-08-10T18:54:19.572389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.551693Z","title":"Auction fever: Rising revenue in second-price auction formats,","venue":null,"work_id":"f483228c-2fbc-4235-8dde-c660007b162b","year":2015},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.175427Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:621ad23c97940aafb213bf811b218b3c30aeb0cafc34ffd92d17e3e60e77f289","observation_id":"8d1aadb1-45c7-4140-85cb-98bc59c70dff","resolution":{"observed_at":"2026-08-10T18:54:19.556907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.536022Z","title":"Path planning and scheduling for a fleet of autonomous vehicles,","venue":null,"work_id":"3b47528f-e89a-4f30-af3d-7a29ac1eeb70","year":2016},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.180100Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:2a3b178b45e5a8cd0f0d7dc9db306ed5e712f5dbc54357e2f71773849e41612b","observation_id":"baf3eb19-fa66-4c0e-b766-c0477e1e65e4","resolution":{"observed_at":"2026-08-10T18:54:19.541367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.519852Z","title":"Autonomous vehicle fleet coordination with deep reinforce- ment learning,","venue":null,"work_id":"40023914-8e90-411e-a8bc-3cc52ea8027a","year":2018},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.184827Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:a334bfacbde246043c2d49dfe92157d58ca2416fa52bd307a9fb38b2f1ad5009","observation_id":"d36e07c8-173e-4559-b7e0-245ae5563799","resolution":{"observed_at":"2026-08-10T18:54:19.524954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.503317Z","title":"Multi-agent reinforcement learning with di- rected exploration and selective memory reuse,","venue":null,"work_id":"d12a73d3-454f-4c0f-bf84-ce8baec7a816","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.189811Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:624326a4aa447daf854479c405c88220accea748b3471bd31e38d26fe6b9acbf","observation_id":"e7411301-cd24-4f55-8dff-89f4059d99f7","resolution":{"observed_at":"2026-08-10T18:54:19.508189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.487162Z","title":"Data-driven dynamic active node selection for event localization in IoT applications-a case study of radiation localization,","venue":null,"work_id":"9c436100-4d62-4293-97ca-82291a2e7d6d","year":2019},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.194537Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:4ff2fb2de88044f8f2e67dbb76fd7b42bd6f2cb1991c1e67aaf1d2c16da6a7be","observation_id":"54bc74fb-09dc-4983-ba4b-b025b353f818","resolution":{"observed_at":"2026-08-10T18:54:19.492301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.470843Z","title":"Reinforcement learn- ing framework for uav-based target localization applications,","venue":null,"work_id":"d6161639-51c3-4e47-a685-7517cd9f5106","year":2023},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.199215Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:a9092806699d6516f1618a5ec21eb8d613d0fdd2b3cc5bf5a533e959450bce3f","observation_id":"6169b1ea-8a36-41dc-bac5-1a1d70eb9666","resolution":{"observed_at":"2026-08-10T18:54:19.476036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.453031Z","title":"A predictive target tracking framework for iot using cnn–lstm,","venue":null,"work_id":"db8e281f-3f7c-4d7f-b9b6-76f0b36cfd68","year":2023},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.204055Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:cadf48566f27c353e2911abec794ac5ecd98b3b167ce0db099a96ed8524f2072","observation_id":"154a7028-4964-4d4e-b027-b3e51978723b","resolution":{"observed_at":"2026-08-10T18:54:19.459449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.435371Z","title":"RFLS-resilient fault- proof localization system in IoT and crowd-based sensing applications,","venue":null,"work_id":"b4e91e5e-66fc-4b46-8b56-9a000384fd44","year":2020},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.208581Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:0e6fe36cd92e1bad624664c0948ad585795ed65a0064c48c81acaa07c36d69ad","observation_id":"fe7d37f9-527a-4b16-acfc-20f125bc31ff","resolution":{"observed_at":"2026-08-10T18:54:19.441035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.419578Z","title":"SDRS: A stable data-based recruitment system in IoT crowdsensing for localiza- tion tasks,","venue":null,"work_id":"dce62b6c-0008-4eed-b93d-6abf8b241696","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.213049Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:94bd651c5a9ae841095912a36b3736cae4158666c5fc66f93e0265c26aac08ca","observation_id":"f3954c10-3e49-4e6a-86bb-7c335cbbfb93","resolution":{"observed_at":"2026-08-10T18:54:19.424868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.403643Z","title":"A uav- assisted search and localization strategy in non-line-of-sight scenarios,","venue":null,"work_id":"ef18b856-8677-407b-87da-5cc5026c3c52","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.217885Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:1d54c258e9f5ecc3709b0d703d8f3d44aa9e3c179c517e311cb57a327711859b","observation_id":"fafdc694-aa35-45ce-b5d1-81f1ed07bd5e","resolution":{"observed_at":"2026-08-10T18:54:19.408887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.387220Z","title":"A matching game-based crowdsourcing framework for last-mile delivery: Ground-vehicles and unmanned-aerial vehicles,","venue":null,"work_id":"69853156-6220-407b-af65-3abc9f45b037","year":2023},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.222608Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:22297c6b3500efdaf403cd2344186f0be524c5759e24abeb5bd05fd45eaec396","observation_id":"e3f0d804-a321-4884-a6b0-94382ca5ef84","resolution":{"observed_at":"2026-08-10T18:54:19.392639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.371170Z","title":"Lenet-5, convolutional neural networks,","venue":null,"work_id":"e8902c34-b6f9-483b-bcdc-222aca312bb3","year":2015},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.227490Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:95abbf5d4508be2bf219714cc8f88fb047ed95428584c0b0b5c61cd0afb84e22","observation_id":"e665bd22-862b-4479-9081-3a6e27cc0ed0","resolution":{"observed_at":"2026-08-10T18:54:19.376243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":40},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2501.10938."}