{"as_of":"2026-08-16T18:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f03a535a6d5fdb16f4af278d874885f45430b39626152c1ef4f06702d88f54bd","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:03:05.962079Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06690/citation-record","integrity":"/paper/2507.06690/integrity","json":"/paper/2507.06690/citation-record.json","paper":"/paper/2507.06690"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:08.367011Z","title":"Grandmaster level in starcraft ii using multi-agent reinforcement learning,","venue":null,"work_id":"0138e404-a8ff-4fe2-b0b4-c79d0df42144","year":2019},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.534330Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:a12861b41d095878a86fded9d3e1e8f7b97c0e4ef3a2facfa8bf5b29a7961090","observation_id":"252f60b8-1fe1-4be1-afa2-f95abcbc39b1","resolution":{"observed_at":"2026-08-06T19:03:08.484394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:08.131499Z","title":"On reinforcement learning for full-length game of starcraft,","venue":null,"work_id":"a28dea1c-66ac-49fb-8930-0ad65561e13b","year":2019},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.605901Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:18036938555f488c3aae47c30df55b374683d7c434b86c9e83432c81e682c3d9","observation_id":"9c579910-42c5-4dcb-bd06-f9964716d599","resolution":{"observed_at":"2026-08-06T19:03:08.251972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:07.807615Z","title":"Distributed multi-robot collision avoidance via deep reinforcement learning for navigation in complex scenarios,","venue":null,"work_id":"2a70ce5d-e169-4095-8b73-c399e74dbe83","year":2020},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.728996Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:f9476cc275fbe7651e36036623b2237ac123c3266073c7ad1dccd6102f74f6ec","observation_id":"b505fe26-b851-417d-907f-5c2e4438a29a","resolution":{"observed_at":"2026-08-06T19:03:07.964508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:07.488135Z","title":"Decentralized multi-agent pursuit using deep reinforcement learning,","venue":null,"work_id":"ae738afc-d830-492d-b205-dffe4c793d9f","year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.809938Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:bc3e73169908c1d1cc5f8a9f0fff0e44ae6b2b1467a5900a7d1c30b83c177c96","observation_id":"f7ce6b66-3c4a-4a1e-8a57-d95ce4a066a4","resolution":{"observed_at":"2026-08-06T19:03:07.650127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:07.337982Z","title":"Multi-agent reinforcement learning for real-time dynamic production scheduling in a robot assembly cell,","venue":null,"work_id":"bd7e3b49-2781-446e-81ab-413e9f47b8d5","year":2022},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.872797Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:6824b448a652126fffd0c55fc0418deb64a795af59fb8de672fa4ea894f882b7","observation_id":"1300d337-a480-49d9-ac5b-f4bb99d033a0","resolution":{"observed_at":"2026-08-06T19:03:07.385747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:07.138368Z","title":"Discovering generalizable multi-agent coordination skills from multi-task offline data,","venue":null,"work_id":"b9324bc0-ef37-4e83-b1db-e5a610bad212","year":2023},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.876565Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:6d353feec1b1dd61a7b906c196ba126677529b9ff5cc1cb869ce222b1419e1f6","observation_id":"e21435d1-df78-46f2-88bb-6615846eddc6","resolution":{"observed_at":"2026-08-06T19:03:07.241513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:05.879909Z","title":"A survey on multi-task learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.879909Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:5089abe7b0976cca477acb06c04ee719a78156990f25550a407e7a8976c88130","observation_id":"88934206-2d97-43d1-97a4-38b5ddb24cf6","resolution":{"observed_at":"2026-08-06T19:03:05.879909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.930294Z","title":"Deep decentralized multi-task multi-agent reinforcement learning under partial observability,","venue":null,"work_id":"f4881479-2d3a-41ea-a548-c6d551d8a49a","year":2017},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.883036Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:53388256b1ab975d89209d0d3d7aac84a8df7288085a2306ccb13fd597d66fd8","observation_id":"9ccefcca-daae-4762-969b-0317b75d92af","resolution":{"observed_at":"2026-08-06T19:03:07.023861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.689057Z","title":"Multi-task deep reinforcement learning with popart,","venue":null,"work_id":"52dfedfc-18b9-4395-a87e-3ead2fbbed9b","year":2019},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.885914Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:eb7e4bd61fc0475bbbfbf769b3121b4ccb1d44571588d02eb8d61af2ff13633f","observation_id":"bd2026cf-861a-4d70-af37-4aa1a7e298ab","resolution":{"observed_at":"2026-08-06T19:03:06.767905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.467409Z","title":"Conflict-averse gradient descent for multi-task learning,","venue":null,"work_id":"ced0f2f8-298d-4fa4-a7b8-ea46658a36ef","year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.888630Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:46ee12de125ea2066e726e62b7428b52e3bc071bac786427e261541464d508f6","observation_id":"f5d2f05f-f7ea-483c-9a91-82a56a62d593","resolution":{"observed_at":"2026-08-06T19:03:06.554548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.284002Z","title":"A deep hierarchical approach to lifelong learning in minecraft,","venue":null,"work_id":"48785c8c-5080-4310-a7e4-7a54ecd40a9c","year":2017},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.891381Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:e02bbb46c9eb17ad3e841e0dda3cdc513e76e64aeb26a50362fe9196fb97aa45","observation_id":"c4388519-cf7d-49a6-a38c-e7e43464a459","resolution":{"observed_at":"2026-08-06T19:03:06.365683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:05.894191Z","title":"Lifelong federated reinforcement learning: A learning architecture for navigation in cloud robotic systems,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.894191Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:572c600303b0053ceeaeb17eaeaa688ff3c599b589448124b591920b14973f34","observation_id":"46e9d9c0-630e-4ec8-aa60-1d37941056a6","resolution":{"observed_at":"2026-08-06T19:03:05.894191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.228328Z","title":"Actor-mimic: Deep multitask and transfer reinforcement learning,","venue":null,"work_id":"800db6aa-b2cd-4467-90bb-a9958dcbc164","year":2016},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.897163Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:d6863a41649b3adf14afb2ed2f57f9e6c76d2cdce5584b1016fee1caf5dc13aa","observation_id":"6f5ef603-9d1a-40b4-94dd-4992e70e09fa","resolution":{"observed_at":"2026-08-06T19:03:06.245842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06295","last_updated":"2016-01-07T18:43:03Z","snapshot_observed_at":"2026-08-14T22:22:10.851051Z","submitted_at":"2015-11-19T18:38:47Z","title":"Policy Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06295","snapshot_observed_at":"2026-08-06T19:03:05.900462Z","title":"Policy distillation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.900462Z"},"links":{"cited_paper":"/paper/1511.06295","citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:9d68394353cded14af711dd72001f5899a76db97bd017d5941e550d37a4d1db2","observation_id":"6cc39fae-9194-40fd-a050-f19f2947ea7f","resolution":{"observed_at":"2026-08-06T19:03:05.900462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.204603Z","title":"Knowledge transfer in multi- task deep reinforcement learning for continuous control,","venue":null,"work_id":"69970aaa-66e6-4889-9707-687be44dc2ad","year":2020},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.903630Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:6f7c664b2449f770f85eff2f8407a097f1a722904e9dcdcfe850c4486d9b158a","observation_id":"21adc34f-7156-4849-ae5c-59f6d0d500c7","resolution":{"observed_at":"2026-08-06T19:03:06.210239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.193937Z","title":"PaCo: Parameter- compositional multi-task reinforcement learning,","venue":null,"work_id":"5bc265ab-b479-49fe-b10d-3abd31d762c7","year":2022},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.906559Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:eb5bbddec903427fab7f3ee52b9c9a0f361af237be68bbddfee2561a9fd21283","observation_id":"04616aa6-11fd-4a9b-990b-614872a5085d","resolution":{"observed_at":"2026-08-06T19:03:06.197830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:05.909654Z","title":"Hierarchical rein- forcement learning: A comprehensive survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.909654Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:f8224905293404b6b5cf50ce7e2b5bfe9a45f9fad4ed44483368e4a2ff67b5df","observation_id":"c5ec42af-e861-4049-85b9-d5d05cb87349","resolution":{"observed_at":"2026-08-06T19:03:05.909654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.177771Z","title":"Planning-augmented hierarchical reinforcement learning,","venue":null,"work_id":"ef1973c8-a5e8-4316-91f0-6267c436a6d8","year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.912205Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:8a26fb63f8410b56b7a1bd997dcaeb4e7c26cbae9b97df3cee2bcfcf0c709d42","observation_id":"35ec6148-e99a-41a5-9301-94c05c5dd0d4","resolution":{"observed_at":"2026-08-06T19:03:06.181379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.168291Z","title":"Learning functionally decomposed hierarchies for continuous control tasks with path planning,","venue":null,"work_id":"4f59ae1c-512d-4710-b529-a6cab35420cf","year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.914752Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:c672b23ecfbbd4389743a01741d51da71bcd6cdabdfe42aca78197283a0311b0","observation_id":"82d39d2d-6a1f-4842-b403-b25b513976c4","resolution":{"observed_at":"2026-08-06T19:03:06.171281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.159443Z","title":"Modular multitask reinforcement learning with policy sketches,","venue":null,"work_id":"cf68f1a3-6006-48ae-8e2e-4f07dfbcb49a","year":2017},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.917778Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:11a5c906e1ad3e41077d4f63199c309426bd097424712ed5b138d46a41a18af0","observation_id":"b9f9c718-bba9-469d-b8de-5c89581545c4","resolution":{"observed_at":"2026-08-06T19:03:06.162471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.148302Z","title":"Adaptive and explainable deployment of navigation skills via hierarchical deep reinforcement learning,","venue":null,"work_id":"00c9b8c2-8fbf-4c16-9352-9cdeef8029f8","year":2023},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.920980Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:44f6093359f3489078ad560ffa31e1a0ce8e0bdc5e84339e48926b3cf80bb574","observation_id":"cdcc9149-0ef4-4c00-9e4d-85fdd25461e1","resolution":{"observed_at":"2026-08-06T19:03:06.152218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.138908Z","title":"Initial task allocation in multi-human multi-robot teams: An attention-enhanced hierarchical reinforcement learning approach,","venue":null,"work_id":"d45e75e9-71a3-4c4d-ae5b-e3938ae245d6","year":2024},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.923894Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:a4f030d9ebe32e9d7272624ac2fd2e471e2b4783e1f36bf7d6da466599285b23","observation_id":"4e9920d0-9fed-4b76-a208-ad1474bfd0e4","resolution":{"observed_at":"2026-08-06T19:03:06.142236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.129554Z","title":"Multi-agent reinforcement learn- ing: A selective overview of theories and algorithms,","venue":null,"work_id":"a60369d7-168b-4ade-9d16-29709a094b43","year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.926615Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:bda28dd53a7d40d0e7336384ea150557738cd35f61470411a5daeb4353b0425e","observation_id":"1edcfe7d-a896-471a-84a4-12cad4a70f37","resolution":{"observed_at":"2026-08-06T19:03:06.132701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06015","last_updated":"2025-02-26T18:10:09Z","snapshot_observed_at":"2026-08-16T14:44:23.342753Z","submitted_at":"2023-11-10T11:59:41Z","title":"Unlock Reliable Skill Inference for Quadruped Adaptive Behavior by Skill Graph","version":2},"cited_work":{"arxiv_id":"2311.06015","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.06015","snapshot_observed_at":"2026-08-06T19:03:05.990521Z","title":"Unlock Reliable Skill Inference for Quadruped Adaptive Behavior by Skill Graph","venue":"cs.RO","work_id":"7a7a08c8-3089-47a4-b082-734a03e01f84","year":2023},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.929189Z"},"links":{"cited_paper":"/paper/2311.06015","citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:6873bc497692f775faeffcd962df457c953d37fc6eb40bb2f7bb036aa9e5f91e","observation_id":"5574b747-85bd-4782-afc2-742335021aed","resolution":{"observed_at":"2026-08-06T19:03:05.995998Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.119666Z","title":"A survey on knowledge graphs: Representation, acquisition, and applications,","venue":null,"work_id":"ff3094c7-c103-4884-b83f-20345e31cf81","year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.932202Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:1b0bb9fad598d55da1fc814d96b3c66e3673ba9a98250e78970d673b5090ac14","observation_id":"7a6df168-86e9-42df-ad05-27ac0d6fbdb6","resolution":{"observed_at":"2026-08-06T19:03:06.123142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.109934Z","title":"Knowledge graph embedding by translating on hyperplanes,","venue":null,"work_id":"0cf6b524-97b1-4806-b489-47e08eb6955c","year":2014},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.935300Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:04b67ee3cedbd787f975cbee1c03c2e27b35f0505879b542c98009159b4e51c4","observation_id":"f1282c2f-a01d-4543-9c67-d4d26f77969b","resolution":{"observed_at":"2026-08-06T19:03:06.113652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.099362Z","title":"Multi-agent actor-critic for mixed cooperative-competitive environments,","venue":null,"work_id":"4099f05f-081c-47c3-a30f-af09043149ec","year":2017},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.938113Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:7f0604bb0b719d4594d653880edad5753eba7a39e8a4805a74873738c2a1c5ac","observation_id":"9831b267-ce1f-41ef-84a9-72cdda9010bd","resolution":{"observed_at":"2026-08-06T19:03:06.103325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.088275Z","title":"Knowledge graph embedding: A survey of approaches and applications,","venue":null,"work_id":"726c291f-a4db-4368-8726-c05860d6cb02","year":2017},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.941010Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:fc629078593631923d89b90f28d082ec5ae13240facf9db85523b090a49e5148","observation_id":"071e1d2b-fdb8-431a-9051-102954303fa6","resolution":{"observed_at":"2026-08-06T19:03:06.092375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.077766Z","title":"A novel framework of knowledge transfer system for construction projects based on knowledge graph and transfer learning,","venue":null,"work_id":"8c4030f1-596d-4342-9b19-b3736a478a67","year":2022},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.944067Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:21918e4c34285363b62d71f235d5cb06ee4739f66c962bfabe4d312410f2055a","observation_id":"2e125195-9350-4a33-b2f8-608feac96a36","resolution":{"observed_at":"2026-08-06T19:03:06.081657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.065307Z","title":"Translating embeddings for modeling multi-relational data,","venue":null,"work_id":"da984092-e5cb-4b11-9474-f51e069af2b4","year":2013},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.946820Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:5f936c98de8f19a3b5d4d1af61a3395aedad7c4d6925d4bfe1cae27619fd1d54","observation_id":"3493bc8d-13ae-457a-a76c-81260e0bfa8c","resolution":{"observed_at":"2026-08-06T19:03:06.070410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.055247Z","title":"Predator–prey survival pressure is sufficient to evolve swarming behaviors,","venue":null,"work_id":"72ba3d0a-fade-4cb8-b502-27a366f23fa8","year":2023},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.949700Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:f702f3deccc6fe3da91ecb091c2566b27e665328bd5352397fe24d7e2eba56db","observation_id":"7a468652-4212-4a50-a0d2-de0863743944","resolution":{"observed_at":"2026-08-06T19:03:06.058427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.044744Z","title":"Swarm robotics: Past, present, and future [point of view],","venue":null,"work_id":"a10cd000-6f0f-473c-86e8-49376ce114c6","year":2021},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.953075Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:c89c4c3822c38edf122f66bc211a20f7eafac4beae567de204a24703902862dc","observation_id":"62708566-44f1-495f-bf94-1ab5611aec30","resolution":{"observed_at":"2026-08-06T19:03:06.048801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.033994Z","title":"Optimized flocking of autonomous drones in confined environments,","venue":null,"work_id":"a6dc0bfc-ab53-4d66-a620-ee0f3e425305","year":2018},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.956426Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:436175f192cccba693ed320dd5fc1c920d6fb75525a3127556981790ed8ff8c2","observation_id":"f4a1252e-d8ed-4ce8-b15d-8d29bf1b37f3","resolution":{"observed_at":"2026-08-06T19:03:06.038164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.024540Z","title":"The surprising effectiveness of PPO in cooperative multi- agent games,","venue":null,"work_id":"edf05f6a-a2a4-4cef-b049-52fdabf36052","year":2022},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.959208Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:7f66e3fd689afdcc03b662520ead589b4db2bcfdddaa34b82dab0004cfac7aa8","observation_id":"fb31f28d-f774-422e-a668-72812642e2ef","resolution":{"observed_at":"2026-08-06T19:03:06.027692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:03:06.014125Z","title":"Omnibot: A scalable vision-based robot swarm platform,","venue":null,"work_id":"beba4a32-11fa-4bf1-9137-88a565f9dbad","year":2024},"citing_paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:05.962079Z"},"links":{"citing_paper":"/paper/2507.06690"},"observation_digest":"sha256:67c067e661f11fc2580e34cf3eafc8fc826dcb5f6bf671baa947229d1ea411a5","observation_id":"0ce90dfe-bb68-483d-9fd2-6b175e4555e3","resolution":{"observed_at":"2026-08-06T19:03:06.017977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.06690","last_updated":"2025-07-09T09:34:41Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T18:54:35.552086Z","submitted_at":"2025-07-09T09:34:41Z","title":"Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":30},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2507.06690."}