{"as_of":"2026-08-17T22:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:935e06305e556622a091322f9e7ca9cd4482123ef37fcdfbad3470339913473c","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:54:25.684713Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T21:55:17.414682Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.14380","snapshot_observed_at":"2026-07-31T21:55:17.414682Z","title":"arXiv preprint arXiv:2509.14380 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27967","last_updated":"2026-07-30T10:14:24Z","snapshot_observed_at":"2026-08-05T12:14:09.489312Z","submitted_at":"2026-07-30T10:14:24Z","title":"MARS-RA: Rank Aggregation for Credit Assignment via Multimodal Comparisons in Embodied Multi-Agent Cooperation","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-07-31T21:55:17.414682Z"},"links":{"cited_paper":"/paper/2509.14380","citing_paper":"/paper/2607.27967"},"observation_digest":"sha256:6642306ab9dca57dcdff3e9722eeb8610609970d537cf5fa7dea26b76abb8b82","observation_id":"e3b92c80-6ea9-4bc6-855f-3eaddf39fdb3","resolution":{"observed_at":"2026-07-31T21:55:17.414682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.14380/citation-record","integrity":"/paper/2509.14380/integrity","json":"/paper/2509.14380/citation-record.json","paper":"/paper/2509.14380"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:25.471129Z","title":"Grandmaster level in starcraft ii using multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.471129Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:93272e10d629fdb4bf766bbbe9b6b85ca7587b6072bbd7400dd31da36cbd32b8","observation_id":"bfd348d9-9681-42b9-b4f9-0ea1c7772c1c","resolution":{"observed_at":"2026-08-15T15:54:25.471129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.447523Z","title":"Smacv2: An improved benchmark for cooperative multi-agent reinforcement learning,","venue":null,"work_id":"75ac4af5-f50c-42ed-a39d-c28b87ea8f80","year":2023},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.476093Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:e5a84ca43efc4788faea7115e9df6d6a5855244be66f3b22861c215af206106d","observation_id":"8d2de1c7-af5c-48fa-a2cb-eb56b88909f7","resolution":{"observed_at":"2026-08-15T15:54:26.451735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.434370Z","title":"Google research football: A novel reinforcement learning environ- ment,","venue":null,"work_id":"b7ba06dc-9059-48d0-91e6-83e040229d9b","year":2020},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.480097Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:5f83238ba413180645e430fc7a0b1d4e54a557b9f61ef83b8c9868d4df6126dc","observation_id":"c984be24-13f0-41d6-b48e-e82efe451f73","resolution":{"observed_at":"2026-08-15T15:54:26.438678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13834","last_updated":"2025-08-30T02:08:59Z","snapshot_observed_at":"2026-08-16T22:40:51.025041Z","submitted_at":"2025-05-20T02:20:54Z","title":"Toward Real-World Cooperative and Competitive Soccer with Quadrupedal Robot Teams","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13834","snapshot_observed_at":"2026-08-15T15:54:25.484412Z","title":"Toward real-world cooperative and competitive soccer with quadrupedal robot teams,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.484412Z"},"links":{"cited_paper":"/paper/2505.13834","citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:24354ecbb7f9653dda679eca7cd135eb73b288d0c2ad507b383714bcacaa91a4","observation_id":"ca312782-fff8-43b2-903c-a1bca889987c","resolution":{"observed_at":"2026-08-15T15:54:25.484412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.419351Z","title":"Marladona-towards cooperative team play using multi-agent reinforcement learning,","venue":null,"work_id":"dd18dde4-5dc0-4788-a12c-88a69d3d7dda","year":2025},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.488698Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:de5810e2e769d5498abb6217fa6e132d34ae6cae089f44d931e59dfe1d33eab2","observation_id":"5410024d-e0b3-4c6f-a16e-afeb15b95fd5","resolution":{"observed_at":"2026-08-15T15:54:26.424331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.404355Z","title":"Leveraging large language models for effective and explainable multi-agent credit assignment,","venue":null,"work_id":"8467cb22-d25e-46fe-9b7d-3d3cec744565","year":2025},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.492665Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:124090210aaeebda5dd76a01d7860a2db9f554eea3750db46de61926ad9c0026","observation_id":"04f420dd-d8b7-479f-89c6-215b3b86a852","resolution":{"observed_at":"2026-08-15T15:54:26.408781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.391347Z","title":"Variational automatic curriculum learning for sparse-reward cooperative multi-agent problems,","venue":null,"work_id":"c5b28aa7-3654-40be-9a70-62ee862c4725","year":2021},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.496970Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:b8d7239397857829014e113506a74f4c46d3b40964b2aa21028bafb2535562ef","observation_id":"80e48075-02d2-459d-920d-fe6e694fbc23","resolution":{"observed_at":"2026-08-15T15:54:26.395734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.378322Z","title":"Au- tomatic curriculum learning for deep rl: a short survey,","venue":null,"work_id":"937db0e1-05dd-4b34-9cb0-5ab19c3bb09f","year":2021},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.500901Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:4977fe4807ebe769fcd30391afd9b885e968874cfecc1a584277807e0253f34c","observation_id":"41dd963c-17e7-487e-b7af-4edb3bcfad14","resolution":{"observed_at":"2026-08-15T15:54:26.382827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.365668Z","title":"Cooperative multi- agent control using deep reinforcement learning,","venue":null,"work_id":"f9d96e40-92d7-48af-bec0-1f20ab6732e8","year":2017},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.504696Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:c094800afb110b3110fcbd4c66802a0fbda675230a824037d58a52de0af81b5a","observation_id":"3bec0d51-1699-44b7-a108-34f3e6946c81","resolution":{"observed_at":"2026-08-15T15:54:26.369660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.352954Z","title":"A survey on curriculum learning,","venue":null,"work_id":"ce17134d-7ce8-4dd7-b2bc-450f7c50a53e","year":2021},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.508560Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:f6583fb8c45c1bf4c79f50b889990a5e3acd30781346f5c779c1b791c006c70a","observation_id":"82e1ea03-1f27-46d0-9d72-56eb9603a1b4","resolution":{"observed_at":"2026-08-15T15:54:26.357203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:25.512447Z","title":"V oyager: An open-ended embodied agent with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.512447Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:34b66953a258efd8bd3c4f402073dd5ca206078805254df255d4cf3663039f24","observation_id":"53f08a60-243d-4b3d-861c-aa2ff4efb29f","resolution":{"observed_at":"2026-08-15T15:54:25.512447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.331637Z","title":"Progprompt: Generating situated robot task plans using large language models,","venue":null,"work_id":"bb45f7f8-5337-40e0-9a8d-2b415f60d8c7","year":2023},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.516437Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:ed5603bc242ca3c37f73233b23bd786b3c12c6a602d1b3ced9c0b6808d3fd6d3","observation_id":"467670c5-1e43-4355-bec0-aa6c91964437","resolution":{"observed_at":"2026-08-15T15:54:26.335775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.319318Z","title":"Eureka: Human-level reward design via coding large language models,","venue":null,"work_id":"f2fbb325-b701-4ac9-b120-cca82766f7e1","year":2024},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.520169Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:876f7175640e54284ecfa7157054419798492b4c90cc14cf8b0f4fcdad8e863f","observation_id":"c7198cff-ef98-401e-b71d-5c8e6dedca4b","resolution":{"observed_at":"2026-08-15T15:54:26.323348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.306955Z","title":"Vision-language models are zero-shot reward models for reinforce- ment learning,","venue":null,"work_id":"27f2c36e-08d1-4582-b5b7-c298254eee58","year":2024},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.523903Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:68eb34405c97599e956262e148aa5fe9f91007ff86fd00432c901cbb7f48befc","observation_id":"5999ba2b-cb4e-4228-9f0c-153f1dc8e89c","resolution":{"observed_at":"2026-08-15T15:54:26.310891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24278","last_updated":"2025-04-02T20:24:22Z","snapshot_observed_at":"2026-08-16T18:09:50.904655Z","submitted_at":"2025-03-31T16:23:44Z","title":"AutoEval: Autonomous Evaluation of Generalist Robot Manipulation Policies in the Real World","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24278","snapshot_observed_at":"2026-08-15T15:54:25.527995Z","title":"Autoeval: Autonomous evaluation of generalist robot manipulation policies in the real world,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.527995Z"},"links":{"cited_paper":"/paper/2503.24278","citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:2c09eba534c3b2d75c47a44e0f1c78504df6c43a5f69830838d4993a01a15c5d","observation_id":"3f031d1d-daf4-4e6e-82b3-412779c604f1","resolution":{"observed_at":"2026-08-15T15:54:25.527995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00371","last_updated":"2024-10-01T03:47:00Z","snapshot_observed_at":"2026-08-16T13:13:53.582695Z","submitted_at":"2024-10-01T03:47:00Z","title":"AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00371","snapshot_observed_at":"2026-08-15T15:54:25.532091Z","title":"Aha: A vision- language-model for detecting and reasoning over failures in robotic manipulation,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.532091Z"},"links":{"cited_paper":"/paper/2410.00371","citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:29f3083959964698d8161ae7e51f8a8833d3c2fd2217dc76ef88e3fb72632964","observation_id":"8930a0ac-e4dd-4b45-97a6-cc10215b69b4","resolution":{"observed_at":"2026-08-15T15:54:25.532091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.295043Z","title":"Reverse forward curriculum learning for extreme sample and demo efficiency,","venue":null,"work_id":"c07a9c67-db7b-4412-ab82-21b3349d195b","year":2024},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.536376Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:a2690e041e394e53f978455fd588a3dcc9b42574911257a0087fde70d399d506","observation_id":"43e83483-c8bc-4b55-b801-2f22a2eb5a5f","resolution":{"observed_at":"2026-08-15T15:54:26.299005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.282682Z","title":"Unsupervised curricula for visual meta-reinforcement learning,","venue":null,"work_id":"19d919bc-c73f-4daa-8220-03136b630dcb","year":2019},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.540053Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:5076c9b183ef691e3edc6c6e5a7be4fac933992889c3558e2fb3efdc4f2c739a","observation_id":"eb2eed43-a4d1-4eb2-ac41-7f3bd4b63424","resolution":{"observed_at":"2026-08-15T15:54:26.287048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.269933Z","title":"Tizero: Mastering multi-agent football with curriculum learning and self-play,","venue":null,"work_id":"0a309bdc-73a4-4880-88cf-e947a3664198","year":2023},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.543864Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:e46a3a9f4af524927c29c8339451e07ae08d1d53079d272aa129b3d2f099524f","observation_id":"9bf021fa-cc3f-44cd-9588-adcb8646f87b","resolution":{"observed_at":"2026-08-15T15:54:26.274314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.256817Z","title":"Curricullm: Automatic task curricula design for learning complex robot skills using large language models,","venue":null,"work_id":"a6c74e96-7eaf-4608-9b61-cf4b1a8bc507","year":2025},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.547623Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:3bb339f98b3fe8399cd0db606bfef024f7be50034843321b56f2b0280d119c16","observation_id":"f33599f5-fe9e-4b02-8a5d-e40a578b5e86","resolution":{"observed_at":"2026-08-15T15:54:26.260883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.244396Z","title":"Environment curriculum generation via large language models,","venue":null,"work_id":"30570bed-cb4e-46c9-a12f-09e361eec27e","year":2024},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.551455Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:02dc6752300f545f8e4fa0464c71263e6914ded06f1ba564bbf68b9ebb71ba43","observation_id":"4c41e92b-a8a1-4d06-9a96-b49deb53824d","resolution":{"observed_at":"2026-08-15T15:54:26.248410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.02507","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:25.860598Z","title":"Aura: Agentic upskilling via reinforced abstractions,","venue":null,"work_id":"7f1c3774-1872-437f-a8e6-11957cceb1c4","year":2025},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.555299Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:011ff8ffd46333470578b774dd7dac9bce69e4bf075af0c0d2e5d7bf425f2ba6","observation_id":"cf87b1ef-6d6b-4f13-a139-328a55e62497","resolution":{"observed_at":"2026-08-15T15:54:25.868764Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06687","last_updated":"2023-10-02T17:20:21Z","snapshot_observed_at":"2026-08-16T18:09:05.820726Z","submitted_at":"2023-09-13T02:56:56Z","title":"Self-Refined Large Language Model as Automated Reward Function Designer for Deep Reinforcement Learning in Robotics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06687","snapshot_observed_at":"2026-08-15T15:54:25.559019Z","title":"Self-refined large language model as automated reward function designer for deep reinforcement learning in robotics,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.559019Z"},"links":{"cited_paper":"/paper/2309.06687","citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:7a2951a2e7b0eeaca9696340424c2be9f9e643a4c02c588e542c5fef46d6ad59","observation_id":"6d781468-3ebb-469d-a818-3f770a8467dd","resolution":{"observed_at":"2026-08-15T15:54:25.559019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12599","last_updated":"2025-02-18T07:15:31Z","snapshot_observed_at":"2026-08-16T18:09:53.035662Z","submitted_at":"2025-02-18T07:15:31Z","title":"Learning a High-quality Robotic Wiping Policy Using Systematic Reward Analysis and Visual-Language Model Based Curriculum","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12599","snapshot_observed_at":"2026-08-15T15:54:25.563421Z","title":"Learning a high-quality robotic wiping policy using systematic reward analysis and visual-language model based curriculum,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.563421Z"},"links":{"cited_paper":"/paper/2502.12599","citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:ab0d440461f6c6d73da22dc26dec7a5337a35b884ff6e92f4e086d32545df795","observation_id":"a8135466-0772-4fd3-a28b-dc8030fee3fa","resolution":{"observed_at":"2026-08-15T15:54:25.563421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.231965Z","title":"Learning multi-agent loco-manipulation for long-horizon quadrupedal pushing,","venue":null,"work_id":"7808a87f-ee8d-4f4d-a85c-fe6070d38ed7","year":2025},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.567725Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:78cefe02da6d2c1c213b099d91eb1c2e3155cefe4bb5903b965f4551f9847073","observation_id":"3df44eb6-1900-476c-a3fb-9db72555d036","resolution":{"observed_at":"2026-08-15T15:54:26.236119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18221","last_updated":"2025-03-23T21:48:26Z","snapshot_observed_at":"2026-08-16T16:21:07.696188Z","submitted_at":"2025-03-23T21:48:26Z","title":"Decentralized Navigation of a Cable-Towed Load using Quadrupedal Robot Team via MARL","version":1},"cited_work":{"arxiv_id":"2503.18221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18221","snapshot_observed_at":"2026-08-15T15:54:25.764633Z","title":"Decentralized Navigation of a Cable-Towed Load using Quadrupedal Robot Team via MARL","venue":"cs.RO","work_id":"eae0efa0-38c8-40ab-80bd-ac827f13bfc8","year":2025},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.571569Z"},"links":{"cited_paper":"/paper/2503.18221","citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:e52d4c0b7ea573538d4d7f08830242d99b8e303a453ef1b1136492e17f25c2a5","observation_id":"47e29ed9-b3e5-461e-93e1-47661611efa2","resolution":{"observed_at":"2026-08-15T15:54:25.769117Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.219059Z","title":"Resolving conflicting constraints in multi-agent rein- forcement learning with layered safety,","venue":null,"work_id":"c8279202-6935-43db-ba12-22449443535d","year":2025},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.575630Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:e617c0ecbe81a6941b612b8584089f2afaaa64658e528510cfa288934143d977","observation_id":"09df2b0d-4bc1-4c4b-8f73-53c8e2a8cc6d","resolution":{"observed_at":"2026-08-15T15:54:26.223514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.206023Z","title":"Learning differentiable and safe multi-robot control for generalization to novel environments using control barrier functions,","venue":null,"work_id":"37cae488-ca88-4e9e-a3a9-03a9de5632f4","year":2024},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.579587Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:caddf89af5a18ab1cf3387b9e6d87aa907aa3b2afcfd3b3be8e735da3646195b","observation_id":"9b8a5644-0d74-4b43-90d2-e2156ecce97e","resolution":{"observed_at":"2026-08-15T15:54:26.210537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:25.583370Z","title":"The surprising effectiveness of ppo in cooperative multi-agent games,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.583370Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:81e275dbf1648658ce7ac246c4409a392ea7bf4bc22f7a017b64ad7d2ff96be1","observation_id":"2c514f9f-1992-4b6f-8bd3-baa8a1f17b11","resolution":{"observed_at":"2026-08-15T15:54:25.583370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:25.587142Z","title":"Monotonic value function factorisation for deep multi- agent reinforcement learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.587142Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:08ed685142d3ee9fb40ea2ef39433c0f18349a2eaa00c4c4d68b70eebd39a0ff","observation_id":"8db63cab-e014-44c2-8443-0c13689dc937","resolution":{"observed_at":"2026-08-15T15:54:25.587142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.177041Z","title":"Lever- aging pre-trained large language models to construct and utilize world models for model-based task planning,","venue":null,"work_id":"9f127756-1c1e-48f3-a7fe-1db4a31ed4a3","year":2023},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.591105Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:66ec77c67de0e3afcd52fab02ccbf6a1b63b0eab247ea1f775342547b1c5865e","observation_id":"019d8fa8-9d48-4e34-bc1a-e8bce33e1a33","resolution":{"observed_at":"2026-08-15T15:54:26.181631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.163855Z","title":"Spatialvlm: Endowing vision-language models with spatial reasoning capabilities,","venue":null,"work_id":"1b337688-7870-4ea7-9971-43490e21641c","year":2024},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.594991Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:6412c45a4b63da3e679b0ca5efbdcb77976055c6ff90a452101aac1a722ff23d","observation_id":"5068b772-177c-4a64-a7ec-04bf3561d021","resolution":{"observed_at":"2026-08-15T15:54:26.168023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.150119Z","title":"3d-vla: A 3d vision-language-action generative world model,","venue":null,"work_id":"0bc3089f-98db-416b-a0c4-503529824604","year":2024},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.598661Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:62f217554283801cfd68f76af5fb8ebb6e8a517c0316780bad75ba460491eaf7","observation_id":"5d084231-cbd8-4df1-bb3a-8e5b54bdfa92","resolution":{"observed_at":"2026-08-15T15:54:26.155306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.137673Z","title":"Synthesizing interpretable control poli- cies through large language model guided search,","venue":null,"work_id":"74bdc5cd-282c-4103-aab5-29a269308ad2","year":2025},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.602490Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:ed10f073af5373b3ab26de1b19e5367cb85262465f1f656cd5e44e1ed8d7db21","observation_id":"99229b5a-4310-498b-9ab3-92911e9b221d","resolution":{"observed_at":"2026-08-15T15:54:26.141819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.125318Z","title":"Large language model based multi-agents: a survey of progress and challenges,","venue":null,"work_id":"9de41c05-c2d4-4dd7-a94b-a582de70767f","year":2024},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.606367Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:b91990506644ed97916f7a6b463a4f92381186e23bd7a8f9646028308b27a6cc","observation_id":"6ccee268-ff84-41cd-bb3e-076658b02488","resolution":{"observed_at":"2026-08-15T15:54:26.129500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03314","last_updated":"2023-06-05T23:55:37Z","snapshot_observed_at":"2026-08-16T16:19:58.635969Z","submitted_at":"2023-06-05T23:55:37Z","title":"Multi-Agent Collaboration: Harnessing the Power of Intelligent LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03314","snapshot_observed_at":"2026-08-15T15:54:25.610221Z","title":"Multi-agent collaboration: Harnessing the power of intelligent llm agents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.610221Z"},"links":{"cited_paper":"/paper/2306.03314","citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:d9f5688d44884847ec76a59c3e64331b2d3d2dcf4fcc30ff9ea120d3a2ceb9f5","observation_id":"05d1178c-76e3-4b09-b877-93bf046888ee","resolution":{"observed_at":"2026-08-15T15:54:25.610221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.112199Z","title":"Loss of plasticity in continual deep reinforcement learning,","venue":null,"work_id":"99cdb23f-f4fb-4cfe-b32d-214d73032e3d","year":2023},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.614266Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:2e95352839d6fb63be3ea6dfd061d3704f6ab906ea2661389574db41a91f3155","observation_id":"fd43f7cc-ca22-4f14-857f-caf601c5f708","resolution":{"observed_at":"2026-08-15T15:54:26.116258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:25.617971Z","title":"Loss of plasticity in deep continual learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.617971Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:9899528d8b866b1c6bcb74de8dd841c4cbe93acc968bcd7f9db4a2551b54621f","observation_id":"57b26db8-69d4-4b03-99f3-d0cab00a88bc","resolution":{"observed_at":"2026-08-15T15:54:25.617971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.090787Z","title":"Mqe: Unleashing the power of interaction with multi-agent quadruped envi- ronment,","venue":null,"work_id":"c21e85a1-685c-4db5-a572-20437b6dc5ed","year":2024},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.621750Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:eb8eed48efaf8b90c405f6fa6d7e66342720538138483dc756521c6eb8ad5cc7","observation_id":"e21494a3-4e0f-41b5-b917-fa0cb5f1d680","resolution":{"observed_at":"2026-08-15T15:54:26.095292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.12293","last_updated":"2025-01-18T02:57:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-25T15:32:31Z","title":"robosuite: A Modular Simulation Framework and Benchmark for Robot Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.12293","snapshot_observed_at":"2026-08-15T15:54:25.625446Z","title":"robosuite: A modular simulation framework and benchmark for robot learning,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.625446Z"},"links":{"cited_paper":"/paper/2009.12293","citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:7f8990d231547b2d2aaa63483615fc21babe17c510cfcdff9d43146ed19e4794","observation_id":"48403b71-ffb5-4bb2-bed3-115817d620c1","resolution":{"observed_at":"2026-08-15T15:54:25.625446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16189","last_updated":"2023-12-20T12:04:06Z","snapshot_observed_at":"2026-08-16T18:09:51.329773Z","submitted_at":"2023-12-20T12:04:06Z","title":"OpenRL: A Unified Reinforcement Learning Framework","version":1},"cited_work":{"arxiv_id":"2312.16189","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.16189","snapshot_observed_at":"2026-08-15T15:54:25.718794Z","title":"OpenRL: A Unified Reinforcement Learning Framework","venue":"cs.LG","work_id":"5672f6f6-ac79-4847-aff2-32c243e42520","year":2023},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.629422Z"},"links":{"cited_paper":"/paper/2312.16189","citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:e979a79d89abf251f62822f3f478f0f2fb59ea479841add8acb9ab217a6fa39e","observation_id":"85e141b3-116a-4bc3-bcab-54e252768353","resolution":{"observed_at":"2026-08-15T15:54:25.725192Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.078629Z","title":"skrl: Modular and flexible library for reinforcement learning,","venue":null,"work_id":"06f9b96e-8dc6-417e-9fb1-1667d9088651","year":2023},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.633475Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:c6940ede0b32e83966a79b1c8cce6144789c51d2b3d1cd7c6207ff95c05f59a0","observation_id":"63c55479-751d-4232-beda-e983aa341a1d","resolution":{"observed_at":"2026-08-15T15:54:26.082715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.066592Z","title":"One for generating candidate curricula, and another for refining the final curriculum from the candidates","venue":null,"work_id":"d9823398-09da-45d9-a575-9199282840cc","year":null},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.637158Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:b515f45dd2f0644ceb0121d443327b7effda60275004c4080664d68a2435500d","observation_id":"412a2675-b44c-49d7-abe5-718e7e9af546","resolution":{"observed_at":"2026-08-15T15:54:26.070532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.053814Z","title":"Prompt 3: LLM prompt for generating base reward function","venue":null,"work_id":"ae5ef29b-5b01-4338-b5fb-06604bc6316c","year":null},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.641403Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:7ca1e614cf15fcc4e0980560e0c7e8166c55ca4f938364b81367ca3f11807b52","observation_id":"2b12f8a9-2420-4080-bf92-41fbe8babed6","resolution":{"observed_at":"2026-08-15T15:54:26.058085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.041475Z","title":"Prompt 4: VLM prompt for policy evaluation","venue":null,"work_id":"f0dcfe3b-a827-467c-af92-74b2499a5030","year":null},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.645383Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:5d15b41e8a8c5658170a79a900e73b1ef11b2445b2ec7121cbc017ef939fadf8","observation_id":"de92ccf1-7880-4fab-b003-8e2ee1cccf2f","resolution":{"observed_at":"2026-08-15T15:54:26.045528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.029289Z","title":null,"venue":null,"work_id":"1b0d015e-cafd-467f-a3ef-57662f122217","year":null},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.649252Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:636627a548b9b088ebdd9ef21a3ff270f842ed31122d7c321c5221d61a3e2cdc","observation_id":"17994f35-dc9a-43c3-92d5-3ceaef5f8513","resolution":{"observed_at":"2026-08-15T15:54:26.033122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.017238Z","title":"very close","venue":null,"work_id":"31b0852d-520a-47b7-99ff-28f90bdbc7fb","year":null},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.653146Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:653c2bba38e2d615ade1a379172cec0ee10fbec45fd69108e2cac820f103bf58","observation_id":"39872ea0-03f2-44a9-95f7-dab277970512","resolution":{"observed_at":"2026-08-15T15:54:26.021042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:26.005055Z","title":"One for generating advice on how to refine the reward (VLM), and one for refining the reward function given the advice (LLM)","venue":null,"work_id":"90fda51e-23e1-4f60-bdc5-4e234e21d8bf","year":null},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.657263Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:b476b90603ebfb95171904c8ca0aba4d30e0872459d5ec069d289077a2e81f83","observation_id":"7cb458cd-b881-466d-b5f9-04b9130e812f","resolution":{"observed_at":"2026-08-15T15:54:26.009147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:25.993075Z","title":"reach_reward","venue":null,"work_id":"3c8bfad5-76bb-41b5-b340-16656893e60c","year":null},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.661293Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:3ef9f4325a706d604db209bc88465f55d89703f3a83c72d890d618cdb1ebac6a","observation_id":"27888c29-f4c7-44de-ad69-98b7fa1811cc","resolution":{"observed_at":"2026-08-15T15:54:25.997016Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:25.979856Z","title":"Because the agents rarely reach that threshold early on, they get almost zero signal to lift beyond ~0.016 m","venue":null,"work_id":"cd5ef027-324f-4f97-bb4a-8fc1ca2b2198","year":null},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.665622Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:0a357daca00568a5f0e5b3c14eb7a6351319002881987e694f18757438b47d02","observation_id":"db39c5b9-9b97-4560-b0b6-11375773a7d0","resolution":{"observed_at":"2026-08-15T15:54:25.984465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:25.966881Z","title":null,"venue":null,"work_id":"e3a7130a-240d-47d8-aa03-797270eb562c","year":null},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.669402Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:c9ebcc923a677ede91e1d80cb8cd390d040769adfb226b72168c3ddb1f92b0a8","observation_id":"9acaca1d-9d2b-4513-9d3a-165aa5292ea5","resolution":{"observed_at":"2026-08-15T15:54:25.970937Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:25.953902Z","title":"Once the handles are touched or grasped, there is little extra push to actually raise the pot","venue":null,"work_id":"3a4667b6-865f-4bb2-873b-c7c288033556","year":null},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.673361Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:a54149ed185ed71a4ea994a14dba33cf2ca2198c86ad840b4ca6ca968aa72b06","observation_id":"7aea6525-0f93-46ff-95fc-5475e0ba5245","resolution":{"observed_at":"2026-08-15T15:54:25.958144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:25.941249Z","title":"This gives gradient toward any increase in height, not just surpassing 0.1 m","venue":null,"work_id":"d8bb35d5-cf13-4066-aa26-80bbeaf621a3","year":null},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.677065Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:258e887104ec02f09f2c150a555b69a192e2db5b6bca6a1e24bb2b52782a9474","observation_id":"bd2ebe99-9204-4922-a3b8-b0b6caf39e59","resolution":{"observed_at":"2026-08-15T15:54:25.945421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:25.928532Z","title":"This still rewards low tilt but provides a gradient that gently pushes the pot back toward upright whenever it begins to tilt","venue":null,"work_id":"5606ef8a-e319-48aa-8f70-7ecce1fb180a","year":null},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.680872Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:497cf7d3f55657c7c3b75bd7c14e019da7bd5b2beba562edea615fdbb2c26985","observation_id":"f8015b13-809b-4d46-924a-ccf9300627fd","resolution":{"observed_at":"2026-08-15T15:54:25.932738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:54:25.915624Z","title":"touch and release","venue":null,"work_id":"38212b4b-71ec-4cd4-b300-2b1785292ad1","year":null},"citing_paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T15:54:25.684713Z"},"links":{"citing_paper":"/paper/2509.14380"},"observation_digest":"sha256:fdb3efaccd7fb09bce03a288ee19fba97a900717c9a341b72961986542da048c","observation_id":"70989a4b-1106-4453-bd86-8174867af71d","resolution":{"observed_at":"2026-08-15T15:54:25.919759Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.14380","last_updated":"2026-06-05T14:04:49Z","latest_version":3,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-16T18:09:17.482090Z","submitted_at":"2025-09-17T19:30:27Z","title":"CRAFT: Coaching Reinforcement Learning Autonomously using Foundation Models for Multi-Robot Coordination Tasks"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":3,"verified_fuzzy":36},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 1 inbound Pith citation observation for arXiv:2509.14380."}