{"as_of":"2026-08-18T12:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e7c34ea70e3c9956e57e53647f3efb0963311877378ff57c683cd10f4335a787","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T08:57:22.592638Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T16:46:29.650500Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T04:49:34.810229Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"cited_work":{"arxiv_id":"2510.18085","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.18085","snapshot_observed_at":"2026-07-04T04:49:34.810229Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","venue":"cs.RO","work_id":"3b0318b9-80ca-466d-ae7b-9857c1129800","year":2025},"citing_paper":{"arxiv_id":"2606.20990","last_updated":"2026-06-18T23:47:27Z","snapshot_observed_at":"2026-07-06T23:56:02.397254Z","submitted_at":"2026-06-18T23:47:27Z","title":"Duet: Dual-Robot Understanding via Efficient Teaching","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T16:46:29.650500Z"},"links":{"cited_paper":"/paper/2510.18085","citing_paper":"/paper/2606.20990"},"observation_digest":"sha256:5e63b5778b94cd6af45f4bbcffe007089f6099784d0757813b6b51f41e141939","observation_id":"6f8ffcb9-ee27-46df-84af-3b0bf3870a98","resolution":{"observed_at":"2026-07-04T04:49:34.812033Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2510.18085/citation-record","integrity":"/paper/2510.18085/integrity","json":"/paper/2510.18085/citation-record.json","paper":"/paper/2510.18085"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:19.432419Z","title":"Decentralized control of a heterogeneous human–robot team for exploration and patrolling.IEEE Transactions on Automation Science and Engineering, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:19.432419Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:ac1e793b7615c05ac5eaa9c70f47090737e8ae5bbd0e9e000f332bf6c19a311a","observation_id":"c47d84fb-e155-4539-ac0b-bf34fc1d0b56","resolution":{"observed_at":"2026-08-04T08:57:19.432419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:19.548299Z","title":"Mapf-gpt: Imitation learning for multi-agent pathfinding at scale","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:19.548299Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:cea852a2d6406738ca3e43e1de94854d2dea915786eeb2d26de5b30226a729e0","observation_id":"46d5f368-b936-46e7-86d3-87d39297f676","resolution":{"observed_at":"2026-08-04T08:57:19.548299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:19.723998Z","title":"Vmas: A vectorized multi-agent simulator for collective robot learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:19.723998Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:42b2333613986c30deb61becc370aeed7a1afa50a921e2f318cb475fb36de0cd","observation_id":"78b94599-6dbb-4a3f-9123-40fd091edafb","resolution":{"observed_at":"2026-08-04T08:57:19.723998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:19.867059Z","title":"Multi-agent imitation learning for driving simulation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:19.867059Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:5c8c229a240ef98f2441a9583ac41b140e9942348933252affdaed8fbb426e00","observation_id":"f86ad048-8d23-45e7-9051-2a042c90c0f2","resolution":{"observed_at":"2026-08-04T08:57:19.867059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:20.000989Z","title":"Adaptive task planning for multi-robot smart warehouse.Ieee Access, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:20.000989Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:fe3c9effe82b10ccf8694fe04a5c296cd8fc07963b34879a1125689f4d75d998","observation_id":"7ea84dcb-7d74-463b-ab20-4982aa6ddd29","resolution":{"observed_at":"2026-08-04T08:57:20.000989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:20.102491Z","title":"Transformer-based imitative rein- forcement learning for multirobot path planning.IEEE Transactions on Industrial Informatics, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:20.102491Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:1d69a1b170f981f886d1783f74793ad9f12cbbd50acada5000ae683e94454437","observation_id":"217d83ce-020e-4534-b67f-705e5053e962","resolution":{"observed_at":"2026-08-04T08:57:20.102491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:20.230446Z","title":"Survey of imitation learning for robotic manipulation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:20.230446Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:7f5c99d41f47ff7d3b00ff81f1f0b1cc2724a1bfbde43933d84bd398710bd914","observation_id":"ea553e3e-7b66-4542-a554-238fdca017ab","resolution":{"observed_at":"2026-08-04T08:57:20.230446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:20.350018Z","title":"Multi-agent generative adversarial interactive self- imitation learning for auv formation control and obstacle avoidance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:20.350018Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:1a3270ebce21de202e3f80d151c4b0ed76bdf1a61de92a9701325373ce11b301","observation_id":"ebc2a797-e768-4c53-b667-599acc9542cf","resolution":{"observed_at":"2026-08-04T08:57:20.350018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:20.472331Z","title":"Teleoperation of multi- robot and multi-property systems","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:20.472331Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:87665c091405ed2de296cfa14cfd177c21f44a1ece3700d8a840bf1239171267","observation_id":"de0a29da-ba22-412f-90e2-55443d2d0027","resolution":{"observed_at":"2026-08-04T08:57:20.472331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:20.602029Z","title":"Multi-agent imitation learning based energy management of a microgrid with hybrid energy storage and real-time pricing.IEEE Internet of Things Journal, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:20.602029Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:3c6881dbd23964deeaae3e39373de0b100f00e5c6356a9fac7bfea39ff2a6ac0","observation_id":"d83fed2c-f6a2-4106-b177-164696e75ecf","resolution":{"observed_at":"2026-08-04T08:57:20.602029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:20.725728Z","title":"Applica- tion of multi-robot systems to disaster-relief scenarios with limited communication","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:20.725728Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:b016795e031087c220190e901b60cdb44043e6fcd7c364667f442b476866f7df","observation_id":"e7283654-c0ee-471c-87ce-6726fb291b7b","resolution":{"observed_at":"2026-08-04T08:57:20.725728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:20.845843Z","title":"Thriftydagger: Budget-aware novelty and risk gating for interactive imitation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:20.845843Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:ea938b127420ee7fc43e002534c9fadc4e61b79e67a2509bfb58c452c50570b2","observation_id":"f249b5eb-8fd0-42b1-8425-b118771526e5","resolution":{"observed_at":"2026-08-04T08:57:20.845843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:20.967152Z","title":"Fleet-dagger: Interactive robot fleet learning with scalable human supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:20.967152Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:f58f423e6d59957b0cfa52389165a130d15c0cf916b4d219791949d744db498e","observation_id":"c86cd62b-8e71-4acf-a676-6a5aabfc18f1","resolution":{"observed_at":"2026-08-04T08:57:20.967152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:21.059052Z","title":"Multi-agent decision-making at unsignalized inter- sections with reinforcement learning from demonstrations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.059052Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:d1ac0144aa62306083d526ebb07bba0904ee99da0eb6cb6c281fd39c146650b4","observation_id":"d6b15b5b-6b9d-4afa-ba56-68138c5e69ce","resolution":{"observed_at":"2026-08-04T08:57:21.059052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:21.141111Z","title":"From one to many: How active robot swarm sizes influence human cognitive processes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.141111Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:5f28d28f2604da93d7ecff78d1243c98f381482a731fbeaba4204f893a6e7fd0","observation_id":"d0c412f5-3c8f-4715-8009-27d841a330ec","resolution":{"observed_at":"2026-08-04T08:57:21.141111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:21.204213Z","title":"Dart: Noise injection for robust imitation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.204213Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:396f14bf8776e1912e9c6c6652bc23ebd6b862a6f2383b3cfa7bf2e4673134db","observation_id":"212f55af-e84e-4f07-91bb-6583c0bfdf64","resolution":{"observed_at":"2026-08-04T08:57:21.204213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:21.253879Z","title":"Coordi- nated multi-agent imitation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.253879Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:e378ca52cba3454c8a05ad7f6cf8be1da664a1f5e36b3a039f878a4f4f451793","observation_id":"5f473fab-1c0a-480c-89e8-43c4d272fc18","resolution":{"observed_at":"2026-08-04T08:57:21.253879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:21.315211Z","title":"A two-stage imitation learning framework for the multi-target search problem in swarm robotics.Neurocomputing, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.315211Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:f9ff8b77f0d92b9bf0b4bae24a7d8924b9ecdcb3b1d5be0ce8119938c6e80191","observation_id":"5d4dd83a-4548-4600-b93d-150d488c9976","resolution":{"observed_at":"2026-08-04T08:57:21.315211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06869","last_updated":"2025-03-10T02:44:36Z","snapshot_observed_at":"2026-08-16T12:51:41.626696Z","submitted_at":"2025-03-10T02:44:36Z","title":"Collective Behavior Clone with Visual Attention via Neural Interaction Graph Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06869","snapshot_observed_at":"2026-08-04T08:57:21.378770Z","title":"Collective behavior clone with visual attention via neural interaction graph prediction.arXiv preprint arXiv:2503.06869, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.378770Z"},"links":{"cited_paper":"/paper/2503.06869","citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:8dca8b1be4dce3f617a761a11547a1a57c8f152868e56402a09346cd85e872a1","observation_id":"15ca4b5f-2e08-4416-b8dc-496014aef819","resolution":{"observed_at":"2026-08-04T08:57:21.378770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:21.416896Z","title":"Controlling assistive robots with learned latent actions","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.416896Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:6579e23d27044fe3f9ac7227d26a18d75b6faa16b63a184209dc8a44298152c4","observation_id":"9bb03ebd-5262-4e06-88ee-7b42a1c8b497","resolution":{"observed_at":"2026-08-04T08:57:21.416896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:21.475924Z","title":"Learn to behave! rapid training of behavior automata","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.475924Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:769feb2e52dffac805d439fae56712dead39803e180f199181b3a94433aa544c","observation_id":"ddd3eb5e-fc49-4df3-b9db-2d8b0c47c6f2","resolution":{"observed_at":"2026-08-04T08:57:21.475924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:21.527270Z","title":"Inverse factorized soft q-learning for cooperative multi-agent imitation learning.Advances in Neural Information Processing Systems, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.527270Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:b6d60fae1e19a04ee230778b5f1e834d1967636ac54b7f1cd0e35d99ca03c108","observation_id":"6987f569-4a36-46da-85fa-675aa3f61a81","resolution":{"observed_at":"2026-08-04T08:57:21.527270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:21.579481Z","title":"Discovery and deployment of emergent robot swarm behaviors via representation learning and real2sim2real transfer","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.579481Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:5bcb7850ee572eb0fc15778a23a0343d4d78f013bb68a072f1eb9480987ea8d7","observation_id":"407f9665-5b72-4e17-b094-6ff9a04f3eeb","resolution":{"observed_at":"2026-08-04T08:57:21.579481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.10495","last_updated":"2021-05-14T20:05:03Z","snapshot_observed_at":"2026-08-16T18:50:03.148388Z","submitted_at":"2021-01-26T00:13:58Z","title":"Transparency in Multi-Human Multi-Robot Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.10495","snapshot_observed_at":"2026-08-04T08:57:21.638126Z","title":"Transparency in multi-human multi-robot interaction.arXiv preprint arXiv:2101.10495, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.638126Z"},"links":{"cited_paper":"/paper/2101.10495","citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:6e7dd161d6cedc9f01ea21a169f109d19fe95b56040115402a8c5ac8faeabfd4","observation_id":"ddc4c9d2-6a7b-471b-9c79-2eda2e35f278","resolution":{"observed_at":"2026-08-04T08:57:21.638126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:21.687636Z","title":"Diffusion- based multi-agent reinforcement learning with communication","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.687636Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:2bc766b3e0f204bba63895fb757d90acc7f8e4148b33c26659d0d488c6953b30","observation_id":"7d161b82-257a-420b-b863-d8b9decbcb36","resolution":{"observed_at":"2026-08-04T08:57:21.687636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:21.765623Z","title":"Collaborative multi- robot search and rescue: Planning, coordination, perception, and active vision.Ieee Access, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.765623Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:951ecf6f489a37e78355d36af5b85f8829410cc87f7307cdfa746f11b550d589","observation_id":"5b879832-faa6-4389-9d26-2ef8b1a3d526","resolution":{"observed_at":"2026-08-04T08:57:21.765623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:21.848985Z","title":"Hero 2.0: A low-cost robot for swarm robotics research","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.848985Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:d39ab77e240f8a0c86ba68986351447333c589838029b28da17e35db1647fbfd","observation_id":"86e53e1c-eef1-405e-954f-962fb66ec814","resolution":{"observed_at":"2026-08-04T08:57:21.848985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:21.904140Z","title":"Efficient reductions for imitation learning","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.904140Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:901c36ca8c3d8b22bf401adb24a92aa6f6091bcb3639034821b90d3c07e253bf","observation_id":"7883979b-1076-4ff2-82ee-8427a5618ed2","resolution":{"observed_at":"2026-08-04T08:57:21.904140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:21.981891Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:21.981891Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:bfd013529fe609961093cd998d462e9437baf9ec11a617879b6563e58e647c6f","observation_id":"8f0ccefb-4af3-48e7-819e-43424bbdb7d6","resolution":{"observed_at":"2026-08-04T08:57:21.981891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:22.064633Z","title":"Multi-robot persistent surveil- lance with connectivity constraints.IEEE Access, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:22.064633Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:37078a3814e50718b64b308d040793135fb9e754b2b39b9cb264982084516386","observation_id":"f1571c28-db55-4086-8aef-307a33fd6ae9","resolution":{"observed_at":"2026-08-04T08:57:22.064633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-04T08:57:22.167565Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:22.167565Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:9acc24edad8139c10c17bf824c13cb053c4d0e81dc32dd0b02a3a83c51151e15","observation_id":"f1ada6b5-62b7-4c8c-93d4-51e131034e1e","resolution":{"observed_at":"2026-08-04T08:57:22.167565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:22.221070Z","title":"Multi- agent generative adversarial imitation learning.Advances in neural information processing systems, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:22.221070Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:4996f376406c21b1e1058fe3b5fe5370d303951a06065833305be8726295f667","observation_id":"53f10039-feec-430b-bf63-d55cde9bd1a3","resolution":{"observed_at":"2026-08-04T08:57:22.221070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:22.262070Z","title":"Lfd training of heterogeneous formation behaviors","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:22.262070Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:561b6dfd1f3af3fb5a86c96702bddb82d089adb7e8e8f650531e928e410e39ee","observation_id":"f55fb283-f08f-41a1-8156-984842905458","resolution":{"observed_at":"2026-08-04T08:57:22.262070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:22.310775Z","title":"Fast multi-robot motion planning via imitation learning of mixed-integer programs.IFAC-PapersOnLine, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:22.310775Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:5b3c7a167f0568b7059699c1a0e69f3531ac9046e59af56d6ce5fe6a76f3260d","observation_id":"189e6021-4beb-4166-92dc-9daf27d67043","resolution":{"observed_at":"2026-08-04T08:57:22.310775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:22.389178Z","title":"Multi-agent imitation learning: Value is easy, regret is hard.Advances in Neural Information Processing Systems, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:22.389178Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:b11474b10509ebd5b665f3267fae2293c901db073dd21beab01c92ae2fb3a1bd","observation_id":"3032f155-e919-4f94-a92d-fe5115142a7c","resolution":{"observed_at":"2026-08-04T08:57:22.389178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:22.472930Z","title":"Reducing cog- nitive load in teleoperating swarms of robots through a data-driven shared control approach","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:22.472930Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:bea742af6dfd43dba82a901a58d1e156ff64726419942be1c285c13580b6b346","observation_id":"95b2d221-2c0b-46ba-b8bc-3cd86cd175be","resolution":{"observed_at":"2026-08-04T08:57:22.472930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:22.538532Z","title":"The surprising effectiveness of ppo in cooperative multi-agent games.Advances in neural information processing systems, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:22.538532Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:94df658cfd667491ef893960cb6a9f04b59e1a56f55ddf173d6f7d502e021c50","observation_id":"20ad99d2-5b36-4fcb-9dc5-922cffb71437","resolution":{"observed_at":"2026-08-04T08:57:22.538532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T08:57:22.592638Z","title":"Clone swarms: Learning to predict and control multi-robot systems by imitation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:22.592638Z"},"links":{"citing_paper":"/paper/2510.18085"},"observation_digest":"sha256:bd147f2c3d7e5361ef1326385374232c61ccd2cd08b4c885159759b262248209","observation_id":"c8d84585-adcb-477b-aa69-10e009800c2c","resolution":{"observed_at":"2026-08-04T08:57:22.592638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.18085","last_updated":"2026-06-16T20:26:40Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-14T00:58:01.074760Z","submitted_at":"2025-10-20T20:24:23Z","title":"R2BC: Multi-Agent Imitation Learning from Single-Agent Demonstrations"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2510.18085."}