{"as_of":"2026-08-12T17:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0c8e31b68e3bb460fec97aea67640063db0d8be601cbff05ea42a87d77a0553a","coverage":[{"denominator":178,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T05:58:47.884807Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.16970/citation-record","integrity":"/paper/2412.16970/integrity","json":"/paper/2412.16970/citation-record.json","paper":"/paper/2412.16970"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:45.648757Z","title":"In: 2019 ICML Workshop on Human in the Loop Learning (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:45.648757Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:9640945ff1532f6a2360ee2491d3134fcdb63af5170d85e174ae78ae51e1a80a","observation_id":"c1a18a74-e176-4f4b-a780-6a98c8447c13","resolution":{"observed_at":"2026-08-11T05:58:45.648757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:45.653360Z","title":"In: AAAI 2024 Workshop on Synergy of Reinforcement Learning and Large Language Models (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:45.653360Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:14dfd84e92e941319efc35b214ebab62f62e01ec1cff030f0884e8fdbe3681df","observation_id":"9b324a29-5190-406c-bd79-1f6b68593a95","resolution":{"observed_at":"2026-08-11T05:58:45.653360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:45.657265Z","title":"In: Ranzato, M., Beygelzimer,A.,Dauphin,Y.,Liang,P.,Vaughan, J.W.(eds.)Advances inNeural InformationProcessingSystems.vol.34,pp.29304–29320.CurranAssociates,Inc","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:45.657265Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:595a9d6b34eee1ce6e1cc29d2a4dcb1211ecb4522c5515dcc6181fda5530d20c","observation_id":"f7b17ba5-8ed2-4428-9bf5-21c75016f494","resolution":{"observed_at":"2026-08-11T05:58:45.657265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:45.661278Z","title":"In: Koyejo, S., Mohamed, S., Agarwal, A., Belgrave, D., Cho, K., Oh, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:45.661278Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:015517238e2ecf5c460c24ee4403d28681f46323156b5c84eaebeeea46324b3c","observation_id":"6eceec97-0d75-45ae-8871-6a7c4a45e09d","resolution":{"observed_at":"2026-08-11T05:58:45.661278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:45.665239Z","title":"In: IEEE ICRA 2024 Workshop on Vision-Language Models for Navigation and Ma- nipulation (2024) 20 D.J.N.J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:45.665239Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:4864e156b0a169e0ac774391477479b3f5c934442b62be15467fbcf9e67db76f","observation_id":"3a0628b1-d7a1-4ea7-a3c5-de7d5891a417","resolution":{"observed_at":"2026-08-11T05:58:45.665239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:45.669272Z","title":"In: Proceedings of the 34th International Conference on Machine Learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:45.669272Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:fdcf429c899222d9708f0b10cf82dba14212a83029c6b43c92001b3131500129","observation_id":"bc24bd1c-2c9b-4903-9b41-033e4bdf9e4f","resolution":{"observed_at":"2026-08-11T05:58:45.669272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:45.673717Z","title":"In: 2021 International Conference on Learning Representations (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:45.673717Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:3268fd9a68c472d2b2473afbd51ca662c1fd831e4f882f8091a4527674e86ceb","observation_id":"6eb52db3-a573-47c9-9eba-8c88c0ef8c8e","resolution":{"observed_at":"2026-08-11T05:58:45.673717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:45.677264Z","title":"Journal of Internet Services and Applications6(13) (2015)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:45.677264Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:dabc3b3fdb4e2c004a0e33c3e86027f54cbde680b385afb087e442ed05c6aad6","observation_id":"f9d2ebd6-c6e1-404a-86da-aeeb26e56de6","resolution":{"observed_at":"2026-08-11T05:58:45.677264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:45.681314Z","title":"In: AAAI-21 Workshop on Reinforcement Learning in Games (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:45.681314Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:998988ce4dcc7575731ed56bd4d5757d59c0c3a69ba398493f009bc8e7f9d821","observation_id":"0ef94222-1a74-4fac-a9b4-4f4de4d3065f","resolution":{"observed_at":"2026-08-11T05:58:45.681314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:45.685380Z","title":"In: The 20th International Joint Conference on Artificial Intelligence","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:45.685380Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:f4ff7de387b3280418bf14b81ef760eb6b1ed77fd234fdb30a471f261d1114be","observation_id":"3d87df03-9dbc-4426-bba1-5d995c5600ee","resolution":{"observed_at":"2026-08-11T05:58:45.685380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-10T08:00:33.857715Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-11T05:58:45.689385Z","title":"https://arxiv.org/abs/2301.08028 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:45.689385Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:a9919fcc69e0c0b18b478b13d146ad610a0b11312ec45047efc35570ccefe955","observation_id":"2c7f9632-3f78-43d2-8622-bdf253c74ad2","resolution":{"observed_at":"2026-08-11T05:58:45.689385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:45.759732Z","title":"Nature588, 77–82 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:45.759732Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:baa7e42497f60da30a004bd0ff764685629e0aa78e31e62ccf9b408acaa5694f","observation_id":"61736877-7e4a-4c13-b698-c87b8c75735e","resolution":{"observed_at":"2026-08-11T05:58:45.759732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:45.870885Z","title":"Journal of Artificial Intelli- gence Research 47(1), 253–279 (2013)","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:45.870885Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:a893b7af936b77c18a48f4163982363dd675c9a025fed97ce5563c678a369a26","observation_id":"6720e0f4-bf9d-400d-bba1-065d38777022","resolution":{"observed_at":"2026-08-11T05:58:45.870885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:45.956892Z","title":"Transactions on Machine Learning Research (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:45.956892Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:4ea8f1549c08c01fdc06f0b138a0f0f5d5841021f92a37cf23bfcfb7261ea2d9","observation_id":"8e0890aa-d257-49b9-abb5-d447ba628b24","resolution":{"observed_at":"2026-08-11T05:58:45.956892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.060316Z","title":"In: Proceedings of the 16th International Symposium on Distributed Autonomous Robotic Systems","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.060316Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:d281a03a431610c758a772cbb6a55f0623e4604e3f1d7e84b61589b0e6be4cc7","observation_id":"5c22ac15-3d1b-43f1-9c37-c9bd93b39773","resolution":{"observed_at":"2026-08-11T05:58:46.060316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-11T05:58:46.161285Z","title":"Voleti, Z.E., Letts, A., Jampani, V., Rombach, R.: Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.161285Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:7c2c6e6855c97c13c42e8ad9ed9ee2b42f8d399416e816f10113ae5b53da036d","observation_id":"094363eb-0b30-44a0-8d03-2a6406402145","resolution":{"observed_at":"2026-08-11T05:58:46.161285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.217314Z","title":"In: Proceedings of the 42nd International Conference on Machine Learning (2025), to appear","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.217314Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:7b4a534f21c7944116051ef2a2f3a9f470ff01ea3e75a8bb0cd91782e9e68688","observation_id":"55a541f0-5d9a-4ba9-a5c7-4690c23f5629","resolution":{"observed_at":"2026-08-11T05:58:46.217314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.221573Z","title":"In: Proceedings of the International Conference on Learning Represen- tations (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.221573Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:408803124c6290e5a20cc6f55e9b046eae2887ada151d894025ac87e88c776a7","observation_id":"6279a1ec-da6b-46ad-9ed0-fdea2f905324","resolution":{"observed_at":"2026-08-11T05:58:46.221573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.225102Z","title":"In: Xing, E.P., Jebara, T","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.225102Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:9790799f41a9d9953cb07616e57aa0477c3968961f5ab6def5993278a220194c","observation_id":"5eb7e4db-3f32-485b-9814-696a94ac1096","resolution":{"observed_at":"2026-08-11T05:58:46.225102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.228649Z","title":"com/google/jax","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.228649Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:82de819a80c26a77efecaff3292bc21cb242e0bc87ee2f0bc078e3d2a2ead983","observation_id":"b2f975e3-e426-49cf-877f-502ca790e334","resolution":{"observed_at":"2026-08-11T05:58:46.228649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.232032Z","title":"Journal of Artificial Intelligence Research43, 661–704 (2012)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.232032Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:e60d0b4bad7a52c36af851098e1861fbe3bb67d7a1cef1461ce65ef9cce40879","observation_id":"f5bbe6b5-1e2e-4347-8acf-be3c87154ed9","resolution":{"observed_at":"2026-08-11T05:58:46.232032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-12T05:40:07.199512Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-11T05:58:46.235238Z","title":"https://arxiv.org/abs/1606.01540 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.235238Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:6775b2c870fd79fcdead5e498522ba33b6d36b4dcd46b878d3290e056beaa274","observation_id":"8960b5c2-825a-435a-bfc3-5113a1971bc5","resolution":{"observed_at":"2026-08-11T05:58:46.235238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.239082Z","title":"ludii.games/downloads/LudiiLanguageReference.pdf (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.239082Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:d35fadd7c723e22c8a2dc1e5d6801efe81ad3c49f43ba1dec42aed66e185f0e5","observation_id":"b45127da-397b-429d-b5d7-9ab27dce14a3","resolution":{"observed_at":"2026-08-11T05:58:46.239082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.242343Z","title":"Phd thesis, Faculty of Information Technology, Queensland University of Tech- nology, Queensland, Australia (2009)","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.242343Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:295c422178aef2e6792b225989b90918380dffbe5c2940498a48d1ad7083bb07","observation_id":"86755f38-9d99-4812-be29-6aad9b1cf29d","resolution":{"observed_at":"2026-08-11T05:58:46.242343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.245666Z","title":"In: Daumé III, H., Singh, A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.245666Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:11cdc8d0058660218208950c2f6b56d2daa6b62bba37e975b0980b7fea8895fc","observation_id":"874265a7-7611-48de-b4b9-c78d285198cc","resolution":{"observed_at":"2026-08-11T05:58:46.245666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.250006Z","title":"In: Chaudhuri, K., Salakhutdinov, R","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.250006Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:b9e30c198b033e295c96ee7e9df33278ea6bf6fa057888e3b5d9cd24a2dc5cea","observation_id":"7d02c1a9-1eff-407e-a464-f586745ef13b","resolution":{"observed_at":"2026-08-11T05:58:46.250006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.253702Z","title":"https://arxiv.org/abs/2109","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.253702Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:5a49fb34288d7bcbb52db02c3c28f43dc820b8a7a57650668adac7f58ff57d54","observation_id":"60c23408-3b2d-4e50-8b0b-2023a24757ad","resolution":{"observed_at":"2026-08-11T05:58:46.253702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.257225Z","title":"In: Larochelle, H., Ranzato, M., Hadsell, R., Balcan, M., Lin, H","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.257225Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:277022d331a2b24959ef77f797a120214143f62f770a6a4b54aee625a35ba74f","observation_id":"04d82de0-8a5b-4867-8aef-eac8990bcab3","resolution":{"observed_at":"2026-08-11T05:58:46.257225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.260751Z","title":"In: Finding the Frame workshop @ Reinforcement Learning Con- ference (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.260751Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:ea5ab593d028959a0ad7b42d399955634507949fe23fe6103148d6a0b662dda7","observation_id":"ee93d440-785e-4dd6-8bfb-e2f8bb57df2c","resolution":{"observed_at":"2026-08-11T05:58:46.260751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13242","last_updated":"2024-09-10T22:29:43Z","snapshot_observed_at":"2026-07-06T18:17:38.280988Z","submitted_at":"2024-05-21T23:09:12Z","title":"Goals as Reward-Producing Programs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13242","snapshot_observed_at":"2026-08-11T05:58:46.264231Z","title":"https://arxiv.org/abs/2405.13242 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.264231Z"},"links":{"cited_paper":"/paper/2405.13242","citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:af5b6a47230d8cfa9a3727a2864412b06823b61167a6eecf76b45288bb32f3d6","observation_id":"cc4ab0f4-224f-48ab-843d-5146b97c2817","resolution":{"observed_at":"2026-08-11T05:58:46.264231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.268336Z","title":"Nature602, 414–419 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.268336Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:b93f8cdd57ebeb0278f45879badeffd57bbb75a2fa8ad2acf149d1641743dc5b","observation_id":"1b688c92-992d-4464-8034-ee839464b159","resolution":{"observed_at":"2026-08-11T05:58:46.268336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.271796Z","title":"In: Proceedings of the 2014 IEEE International Conference on Robotics and Automation (ICRA)","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.271796Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:42d50b42af1f01b07a47e8b4cfcff9c06aa08d84490ca0dd008ec1d313324761","observation_id":"1575d8d0-0339-4598-84d0-1b2cf4742c28","resolution":{"observed_at":"2026-08-11T05:58:46.271796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.275384Z","title":"In: Advances in Neural Information Processing Systems","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.275384Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:b68cb0a3f80f4e3e2a5845324a335e5a76683a9cc1d375612bf7cb128a1bdd0a","observation_id":"53e0267b-b055-4328-a6db-2f189b30c118","resolution":{"observed_at":"2026-08-11T05:58:46.275384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.279126Z","title":"In: Proceedings of the 38th International Conference on Software Engineering","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.279126Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:1fbb18dc6d4616afca609fcbe1f4aceeace0b5a74f4fec6599bd0d324ef01ee6","observation_id":"3e8b8a27-f6d4-42ef-a99d-fbdcecb92817","resolution":{"observed_at":"2026-08-11T05:58:46.279126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.282371Z","title":"In: Pro- ceedings of the Thirtieth International Joint Conference on Artificial Intelligence","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.282371Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:51f99eb156f62deea610863bae1113c19e9856ea13caa427712234edd493c712","observation_id":"faebda21-b743-4c6a-815f-b93183187ed8","resolution":{"observed_at":"2026-08-11T05:58:46.282371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.287352Z","title":"In: Krause, A., Brunskill, E., Cho, K., Engelhardt, B., Sabato, S., Scarlett, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.287352Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:319d0c2a0473d40cd5819457bcd4e2a6bcbb78ae50ae014063e3575a96f14242","observation_id":"414d6da7-8ce5-4a82-b13f-2424ab65cc6c","resolution":{"observed_at":"2026-08-11T05:58:46.287352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.291054Z","title":"In: Advances in Neural Information Processing Systems (2023), accepted","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.291054Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:bc81855008aaa134912e57907722d17f75608b3bfd843ff41cd7fa410b6ccd91","observation_id":"dd04f2cb-5ec1-407f-a25a-de5a113ec287","resolution":{"observed_at":"2026-08-11T05:58:46.291054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00123","last_updated":"2020-01-17T23:25:22Z","snapshot_observed_at":"2026-08-09T08:49:17.514020Z","submitted_at":"2018-09-29T00:52:34Z","title":"Generalization and Regularization in DQN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.00123","snapshot_observed_at":"2026-08-11T05:58:46.294480Z","title":"https://arxiv.org/abs/1810.00123 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.294480Z"},"links":{"cited_paper":"/paper/1810.00123","citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:a579cc4780701343a5546ad5c5bcca1ba00d33201af63cf50abaaacc2f810ef6","observation_id":"9a183f81-0082-471d-beb2-14c07b8694a8","resolution":{"observed_at":"2026-08-11T05:58:46.294480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.298435Z","title":"Progress in AI2(1), 13–27 (2013)","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.298435Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:d05e01d241cdcb662c406d08833233345f6d7568222578dfdb7945b6de6aae54","observation_id":"ef8d0ba9-cf54-47c9-9ce7-0cc098af63f7","resolution":{"observed_at":"2026-08-11T05:58:46.298435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.323438Z","title":"In: Precup, D., Teh, Y.W","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.323438Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:4c0ea4a95ad307b57825fc898c56f8bfd92f879c88d91ef191e9f0378470d196","observation_id":"7883edab-b015-41f8-a58e-59cc0ce6a9aa","resolution":{"observed_at":"2026-08-11T05:58:46.323438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.391570Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.391570Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:583aca37b8f80cc272fd430d115cb3f66de301cf3caf918f2b57f0e314e8d220","observation_id":"d3fa7474-c906-4ecb-8502-c47f80ff5fe1","resolution":{"observed_at":"2026-08-11T05:58:46.391570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.469490Z","title":"In: ICAIF ’23: Proceedings of the Fourth ACM International Conference on AI in Finance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.469490Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:21c5bf271141a65f89c07bcc5d2e177d7e40332011063a455ca9db16cd9bcede","observation_id":"580ff589-0451-450c-bf12-8beba9744fa4","resolution":{"observed_at":"2026-08-11T05:58:46.469490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.585369Z","title":"In: Proceedings of the 36th International Conference on Machine Learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.585369Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:732251a95dc99071c9113ab6e94f48894248eeaa669dc865614557c5b76ee512","observation_id":"e14cafa9-3bf1-4d46-a4fd-153b066455f4","resolution":{"observed_at":"2026-08-11T05:58:46.585369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.628371Z","title":"Synthesis Lectures on Ar- tificial Intelligence and Machine Learning, Morgan & Claypool Publishers (2014)","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.628371Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:dc48dad17896c30ed9802b18baa7ad058174005205d13c925d4f7de4d03b8a01","observation_id":"a7d87132-9ac7-491b-ab4d-6276e7de6bb2","resolution":{"observed_at":"2026-08-11T05:58:46.628371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.716829Z","title":"In: Ranzato, M., Beygelzimer, A., Dauphin, Y., Liang, P., Vaughan, J.W","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.716829Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:bd1050a70b2b588d8628922125dcf70972f1cf7260d95c831aaebea1cca22c96","observation_id":"7b04ad2b-8281-48f3-bb52-8b93f6452ba9","resolution":{"observed_at":"2026-08-11T05:58:46.716829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.720713Z","title":"In: Brazilian Conference on Intelligent Systems (BRACIS)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.720713Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:84592b2e667a095fd56e6a83810727fa0024dc5f02e7cc33f6915771c5eaf62e","observation_id":"cdf26cb5-4b5f-4465-bed6-366e50727e7e","resolution":{"observed_at":"2026-08-11T05:58:46.720713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.725085Z","title":"Ex- pert Systems with Applications156 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.725085Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:4d798bc43128a887c65caea8ca5a128632e622740f89e5351dc6e2c79f127f54","observation_id":"44029e9b-64fe-41b6-b2b0-6ca9f4880aa0","resolution":{"observed_at":"2026-08-11T05:58:46.725085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.729311Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.729311Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:cfb75b797f5941710b19f32e1c9f7f888f585b29c7c956bae2c8de9162a5cc0b","observation_id":"df721719-3770-492f-aae9-37650703c0eb","resolution":{"observed_at":"2026-08-11T05:58:46.729311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.733577Z","title":"In: The Thirty-Fourth AAAI Conference on Artificial Intelligence","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.733577Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:b9e0efd4ad2d34ec0fce36f416808d7158a42db8c363fa63e675aadbdc2ee37b","observation_id":"155cb549-98b3-43f2-9863-db67f2cefdb7","resolution":{"observed_at":"2026-08-11T05:58:46.733577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.741364Z","title":"In: Proceedings of the 2020 Conference on Robot Learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.741364Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:18fce7601283804ee9c8f5464301bae7ff80c975230666753c01590b3fdec067","observation_id":"cf6536a3-0b13-499c-88c6-251a7ff118cf","resolution":{"observed_at":"2026-08-11T05:58:46.741364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.745224Z","title":"In: Proceedings of the Neural Information Processing Systems Track on Datasets and Benchmarks (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.745224Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:fc81b1018cfb46978b55c358122525dbd8eed5e08933b0990e9fa699ecf025b6","observation_id":"13c52458-89e4-4ae3-b2a3-52008e88da7f","resolution":{"observed_at":"2026-08-11T05:58:46.745224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.749167Z","title":"In: Proceedings of the 42nd International Conference on Machine Learning (2025), to appear","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.749167Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:4407d29677dbcdc82e34147df6d36bab610f062c97e6fb0e6fda354bad53ede6","observation_id":"26ef981d-3797-4f31-8a78-db8ffeeaf032","resolution":{"observed_at":"2026-08-11T05:58:46.749167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.787339Z","title":"In: Proceedings of the 32nd AAAI Confer- ence on Artificial Intelligence","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.787339Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:b86f04f333f8747cadfce5b560a8c23415d0c7a6d949f7312dfecb8523ab4320","observation_id":"b5e7e02c-abf0-4685-8b28-c20b32be1f6e","resolution":{"observed_at":"2026-08-11T05:58:46.787339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:46.889420Z","title":"Communications of the ACM64(12), 58–65 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:46.889420Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:bee1726874fa3ee6f3e8ac90a391e3710f8043aed5811c4fb8e701e53a373d77","observation_id":"a4a7763c-4003-431e-8007-7157719e24e2","resolution":{"observed_at":"2026-08-11T05:58:46.889420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.005431Z","title":"The MIT Press, Cambridge, Massachusetts (1960)","venue":null,"work_id":null,"year":1960},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.005431Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:d2cbf638e32741b4ca793628ee62cca53f480a75e20f4a9bfdaf6f4a97cbba7d","observation_id":"4ab158b0-249f-45e4-a82b-2928ae78158b","resolution":{"observed_at":"2026-08-11T05:58:47.005431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.009105Z","title":"In: ICML 2019 Workshop on Understanding and Improving Generalization in Deep Learning (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.009105Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:e939101572bfe042b963457c1be3166357a28173fc5d8e6af5dbbd739149837f","observation_id":"36a764f4-242d-4419-b299-c88b8bee5832","resolution":{"observed_at":"2026-08-11T05:58:47.009105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.012965Z","title":"In: Advances in Neural Information Processing Systems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.012965Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:0c7ce7a64218a1df1053ae9e22e2b08050bdbde631bc2f8cccc53f55a631ec5e","observation_id":"9bd7810f-bd49-4407-9aa8-09d7dd3e56e5","resolution":{"observed_at":"2026-08-11T05:58:47.012965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.016824Z","title":"it’s unwieldy and it takes a lot of time","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.016824Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:25fc3d02ad45e43aedd61a336b78d109e139d43c9e3f9288e6e6d6e524404a97","observation_id":"7dd88d41-be7a-41e3-b419-64bfe3bcd137","resolution":{"observed_at":"2026-08-11T05:58:47.016824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.020593Z","title":"In: Salakhutdinov, R., Kolter, Z., Heller, K., Weller, A., Oliver, N., Scarlett, J., Berkenkamp, F","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.020593Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:43506411194edb962616d0339439aefc3e4ec408cfe7b2c916873c98b5cbf988","observation_id":"42845223-9ab0-4c1e-bfd8-fd6902d4124c","resolution":{"observed_at":"2026-08-11T05:58:47.020593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.024403Z","title":"https://nips.cc/ virtual/2022/63891 (2022), opinion talk contributed to the Deep Reinforcement Learning Workshop at NeurIPS 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.024403Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:639b812942918a1ebab3262371c16654faf9f73004f5779a5329feeb5bb9791e","observation_id":"5ac11976-60fd-47ab-9494-61b132190932","resolution":{"observed_at":"2026-08-11T05:58:47.024403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.028728Z","title":"In: Advances in Neural Information Processing Systems","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.028728Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:e85c1252eb119cf5865b104c8e556bf241e894884747f61c743025a9bc90c908","observation_id":"7a1d20b0-d3f2-4ce0-84f0-ae16eb315b8f","resolution":{"observed_at":"2026-08-11T05:58:47.028728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.126584Z","title":"In: NeurIPS 2018 Workshop on Deep Reinforcement Learning (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.126584Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:e716e9d81258db9532a0706f22ea56b4740a57eaf4ea56cce743e00254be33ee","observation_id":"e6ddfe2c-31c6-4394-8cdb-0fd66707de0c","resolution":{"observed_at":"2026-08-11T05:58:47.126584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.203595Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.203595Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:abb353e8397c83bfe4442768ec8e29a47f371fd57333fd3065071078d43e59a6","observation_id":"0bd4069b-65b9-4fa3-940f-1006587d0f75","resolution":{"observed_at":"2026-08-11T05:58:47.203595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.314362Z","title":"Transactions on Machine Learning Research (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.314362Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:fe41070ea07c789869e43101f2cec5525db04141315de5c036697c65d8aa6214","observation_id":"407159c4-c168-48f5-9fa0-5b15fc616186","resolution":{"observed_at":"2026-08-11T05:58:47.314362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02991","last_updated":"2024-01-03T17:32:13Z","snapshot_observed_at":"2026-08-09T10:58:15.076076Z","submitted_at":"2024-01-03T17:32:13Z","title":"GLIDE-RL: Grounded Language Instruction through DEmonstration in RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02991","snapshot_observed_at":"2026-08-11T05:58:47.355872Z","title":"https: //arxiv.org/abs/2401.02991 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.355872Z"},"links":{"cited_paper":"/paper/2401.02991","citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:47c784bd5b708b067afe450ff4f56fd8a46f15eb2640746ed56be9bb43f0e7f9","observation_id":"05cf6c77-d3a5-48bc-b8c7-fe027b0352a6","resolution":{"observed_at":"2026-08-11T05:58:47.355872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.360622Z","title":"Journal of Artificial Intelligence Research 76, 201–264 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.360622Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:7d347cd3ec0fbf96c81ec1bb5a6b7845841c689f32c1d682b68f7cf1d019d843","observation_id":"709a0bc0-11a5-4ac9-8d26-7e1bce5936d9","resolution":{"observed_at":"2026-08-11T05:58:47.360622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.364662Z","title":"In: Proceedings of the 2020 IEEE Conference on Games","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.364662Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:df7cd9b513ba1dc598f021c28aa1980bca7c065242b1a65dc0e8ee1164de6630","observation_id":"1b2bc2a0-9294-496f-85dc-b5b242bc66b5","resolution":{"observed_at":"2026-08-11T05:58:47.364662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.368765Z","title":"In: Proceedings of the 33rd AAAI Conference on Artificial Intelligence","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.368765Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:fb70d2bc8faff9b0c5ae11fca020c6c673a68c6c78dda839441f6e96bd092309","observation_id":"77087757-53d8-4edd-beef-10d02b6711f5","resolution":{"observed_at":"2026-08-11T05:58:47.368765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.373248Z","title":"In: Advances in Neural Information Processing Systems (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.373248Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:f3f1f723e5f3e29f3f37fbf46024f3d796bbd777e118d24be557964bb8009153","observation_id":"3fab28db-240b-48eb-b2e1-d48b46622b0e","resolution":{"observed_at":"2026-08-11T05:58:47.373248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.376899Z","title":"In: Kok, J., Koronacki, J., Mantaras, R., Matwin, S., Mladenič, D., Skowron, A","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.376899Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:508378b2fda8fedb72204c89d6c245ec15485000e631f2d2dc1369efe642b897","observation_id":"95cae232-e215-46de-8f9c-25c206765832","resolution":{"observed_at":"2026-08-11T05:58:47.376899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.382103Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.382103Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:776d872c8be2246a4e1d3dc5334e6af9181f18fdb34a755e37c3f3e22281d1d3","observation_id":"182c6810-64d1-4a38-aed7-090998609324","resolution":{"observed_at":"2026-08-11T05:58:47.382103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.386383Z","title":"In: Neural Networks","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.386383Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:a848406df1852da2803b9cd1c5b0e0828b645fa13d9498e7eec0d8fca34bf86e","observation_id":"375cd35c-2bbd-4163-bb77-0e08edd8ecad","resolution":{"observed_at":"2026-08-11T05:58:47.386383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.519639Z","title":"In: Wiering, M., van Otterlo, M","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.519639Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:2e56246f20df01e3394dd797d8716f22155e7e253f52dabf44dd3a4fe7cee744","observation_id":"97195686-1a44-4381-a526-8d31c5461cb4","resolution":{"observed_at":"2026-08-11T05:58:47.519639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.608038Z","title":"Nature521(7553), 436–444 (2015)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.608038Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:42183e22cc2d745e6f87f2a813170fe0ed6689d6ed79275736ccc8910c3b2259","observation_id":"8c7127af-7b94-44c2-8ec6-2c15218ccca4","resolution":{"observed_at":"2026-08-11T05:58:47.608038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14892","last_updated":"2023-06-26T17:58:50Z","snapshot_observed_at":"2026-08-11T07:43:25.454227Z","submitted_at":"2023-06-26T17:58:50Z","title":"Supervised Pretraining Can Learn In-Context Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14892","snapshot_observed_at":"2026-08-11T05:58:47.657835Z","title":"https:// arxiv.org/abs/2306.14892 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.657835Z"},"links":{"cited_paper":"/paper/2306.14892","citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:a21576e47ba5cddf8761ae180df615a3dee1c7fcbcb685b956498cd5460e422b","observation_id":"c42bf182-47db-44f6-9c24-324797390aa0","resolution":{"observed_at":"2026-08-11T05:58:47.657835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00109","last_updated":"2024-09-04T09:27:05Z","snapshot_observed_at":"2026-08-08T16:04:42.510621Z","submitted_at":"2023-07-26T18:58:53Z","title":"A Sentence is Worth a Thousand Pictures: Can Large Language Models Understand Hum4n L4ngu4ge and the W0rld behind W0rds?","version":2},"cited_work":{"arxiv_id":"2308.00109","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.00109","snapshot_observed_at":"2026-08-11T05:58:49.994941Z","title":"A Sentence is Worth a Thousand Pictures: Can Large Language Models Understand Hum4n L4ngu4ge and the W0rld behind W0rds?","venue":"cs.CL","work_id":"222ba636-005d-4aa2-a1b2-0971a37c58fc","year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.662493Z"},"links":{"cited_paper":"/paper/2308.00109","citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:b246b0d3a7210e4080363019f71c0ce9a3fe09c6b3b612297129cfd01040dcf6","observation_id":"1f01f194-ee8c-42a3-885b-e6dfb0e8f6ba","resolution":{"observed_at":"2026-08-11T05:58:49.999758Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.666645Z","title":"Journal of Machine Learning Research10(40), 1131–1186 (2009)","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.666645Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:63604bdc173fead990c95bd4f2bff98c695c8cd7ca3cfcd301012bac8c5ebf09","observation_id":"fe8eff10-bda6-449d-9346-55d3bb9eb55d","resolution":{"observed_at":"2026-08-11T05:58:47.666645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.670393Z","title":"In: Agmon, N., Taylor, M.E., Veloso, E.E.M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.670393Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:00fcdd0cb63434063605b3b78c1f5eb07fffac9c33c612496cbd030fd305d4dc","observation_id":"8de60114-ad82-4159-95a9-6980fe29aeb2","resolution":{"observed_at":"2026-08-11T05:58:47.670393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00937","last_updated":"2024-02-04T04:57:08Z","snapshot_observed_at":"2026-08-12T09:34:48.580055Z","submitted_at":"2023-06-01T17:39:41Z","title":"STEVE-1: A Generative Model for Text-to-Behavior in Minecraft","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00937","snapshot_observed_at":"2026-08-11T05:58:47.673903Z","title":"https://arxiv.org/abs/2306.00937 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.673903Z"},"links":{"cited_paper":"/paper/2306.00937","citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:c76962ad07589f6aad6b25a75f0dfe20b19d9c40eca3d4d90f7a0582d4e4372c","observation_id":"28712a26-0a93-44c7-a93a-891e5ff925ab","resolution":{"observed_at":"2026-08-11T05:58:47.673903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.677745Z","title":"In: Proceedings of the International Conference on Automated Planning and Scheduling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.677745Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:83b28ec1629d36524bb4cc57c1fa296fa05668a8528e08b630bb7de8c4841cf5","observation_id":"cb4303bb-3a15-4f11-b595-07f873a0f43b","resolution":{"observed_at":"2026-08-11T05:58:47.677745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.681865Z","title":"In: Proceedings of the 41st International Conference on Machine Learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.681865Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:ee16e21896531f3f66427e5aa8e69df74c7c380872299f93164e9405d6117cee","observation_id":"bd268545-ca75-49ab-9e0b-afd2e0c1a820","resolution":{"observed_at":"2026-08-11T05:58:47.681865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.685882Z","title":"In: Proceedings of the Eleventh International Conference on Machine Learn- ing","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.685882Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:8ea6017d9377345e73ac80e5aeacdd89d56718ffbf54a87a5f3ea5817a613fdc","observation_id":"313c9429-27ae-4034-9cb1-174baf375898","resolution":{"observed_at":"2026-08-11T05:58:47.685882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.689691Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.689691Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:8a3b5482a86ba9b34688224f48c7b57c7e9bcbc29b2ee9042193ba94dd768087","observation_id":"3939e438-d34b-48df-bdb3-e6b87b817886","resolution":{"observed_at":"2026-08-11T05:58:47.689691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.693287Z","title":"In: Proceedings of the Twenty-Eighth International Joint Conference on Artificial Intelligence, IJCAI-19","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.693287Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:3f2411412d9fa6edf099507516df077c658f5b46472da6443aefe5f36a1167c0","observation_id":"6f494943-bca3-4dfe-ba55-ab331bed80f4","resolution":{"observed_at":"2026-08-11T05:58:47.693287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.808109Z","title":"In: Towards Generalist Robots: Learning Paradigms for Scalable Skill Acquisition @ CoRL2023 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.808109Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:9f4662537e066ea837f9624ca2a96f39fa998ee80baa1778a3d26f41f7cd0b1e","observation_id":"4c6b9cb0-e519-4e19-bca1-810a9f6c1efe","resolution":{"observed_at":"2026-08-11T05:58:47.808109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.830661Z","title":"Journal of Machine Learning Research 9(86), 2579–2605 (2008)","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.830661Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:5cd5645c8bb5ffa544fa90d0bd35243a00947cedbeee7d1e918c54962a271835","observation_id":"8cc89595-9359-45d1-9283-c1c6cb8882c0","resolution":{"observed_at":"2026-08-11T05:58:47.830661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.834396Z","title":"Journal of Artificial Intelligence Research61, 523–562 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.834396Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:6e674fca8ba5d91fd784041f053d000e09c8f3f65a9419eb6ac9c92f9699c5f0","observation_id":"c01c69ab-e87b-4334-8bf6-df310a3263ae","resolution":{"observed_at":"2026-08-11T05:58:47.834396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.838980Z","title":"Machine Learning 22, 251–281 (1996)","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.838980Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:73d08d2268baa1026130cd937c1a05bb14a51b82b921b86333ed83a0918ebc5e","observation_id":"0eff0248-8610-4ce0-9254-7b7ac7f93093","resolution":{"observed_at":"2026-08-11T05:58:47.838980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.843166Z","title":"In: Vanschoren, J., Yeung, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.843166Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:0464c608399217053b28cd1dbc0abcc26af9a15ad52d59820b6989cf7062bf5e","observation_id":"2c156d7a-b1df-45cd-87b1-d13683bc9648","resolution":{"observed_at":"2026-08-11T05:58:47.843166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.846914Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.846914Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:d9f4edb45d5c0769f6bf4b3ca52fdabf08a77ddc218959aa38454968d25783bc","observation_id":"2980eee0-96dd-4953-af1b-1fc8bce12b6b","resolution":{"observed_at":"2026-08-11T05:58:47.846914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.01320","last_updated":"2023-01-03T19:21:10Z","snapshot_observed_at":"2026-07-06T14:37:13.024150Z","submitted_at":"2023-01-03T19:21:10Z","title":"Towards Deployable RL -- What's Broken with RL Research and a Potential Fix","version":1},"cited_work":{"arxiv_id":"2301.01320","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.01320","snapshot_observed_at":"2026-08-11T05:58:49.953701Z","title":"Towards Deployable RL -- What's Broken with RL Research and a Potential Fix","venue":"cs.LG","work_id":"181d8a65-6787-4c46-bdbe-f22ab37223e7","year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.853978Z"},"links":{"cited_paper":"/paper/2301.01320","citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:c8e0c90347fee538c574702b02dbcc16f6db2a53b47136ef1f62a5ddb851eb2f","observation_id":"8ce1deea-fdb0-4524-a65a-b2afe7a8024f","resolution":{"observed_at":"2026-08-11T05:58:49.971815Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.857184Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.857184Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:43ee1b26b6c1bf78ef3246a8c2be052aa9733f256a1ece62169730cdce9a219e","observation_id":"9b419050-f68e-4bd7-9272-c99526e74ab4","resolution":{"observed_at":"2026-08-11T05:58:47.857184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.860789Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.860789Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:57a0b121590914d18439e5e68eb274b113da57393a587ae7ee0d700ba105a2cc","observation_id":"1b8e44cc-ad57-46e8-8298-d79899b7814e","resolution":{"observed_at":"2026-08-11T05:58:47.860789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.863928Z","title":"In: 2024 International Conference on Learning Represen- tations (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.863928Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:59c88f47e0c515ef77b72f5cf8b592daed26cbd5423a48df53d0709ec0743e11","observation_id":"0f14b27c-f7c4-4598-8738-b18250810a32","resolution":{"observed_at":"2026-08-11T05:58:47.863928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.867987Z","title":"ACM Computing Surveys37(4), 316–344 (2005) 26 D.J.N.J","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.867987Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:f226ff51d999c09bee477ec98cbf83a991f84a0267744fda7fae7ff4b1f01a6c","observation_id":"06b0a92f-fa35-4d11-9eaf-9f1b57a13136","resolution":{"observed_at":"2026-08-11T05:58:47.867987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.871745Z","title":"Nature594, 207–212 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.871745Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:760f874bfbae6fb7fa4a1d5cdff00db79a32f08ce12633280244bb5ad1332b89","observation_id":"8153bff4-f384-4055-b054-283314f3d4bd","resolution":{"observed_at":"2026-08-11T05:58:47.871745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.875153Z","title":"In: Palmer, M., Hwa, R., Riedel, S","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.875153Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:d3c66792fbf54f24965776cde1d928fec0a7ca92b0ef7287b89e8158f0e816a6","observation_id":"72550cb5-6152-4f3f-a14e-3301b423b7c0","resolution":{"observed_at":"2026-08-11T05:58:47.875153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.878428Z","title":"In: 2019 IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops (CVPRW)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.878428Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:3da1dc61e7abdf8c1a2629953ffac1d3db54c0cc771e42a821c2a274f5ae0ec0","observation_id":"bf1702a2-eed0-43a1-8c7d-71ebc000d1c0","resolution":{"observed_at":"2026-08-11T05:58:47.878428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-12T14:28:10.961989Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-11T05:58:47.881471Z","title":"https://arxiv","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.881471Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:38672803ba934fa44a42962a754856b675a97565a77de63203fdf5ebec42ff4c","observation_id":"28838940-8c0f-40dd-bd37-fe519659da6d","resolution":{"observed_at":"2026-08-11T05:58:47.881471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T05:58:47.884807Z","title":"In: Faust, A., Garnett, R., White, C., Hutter, F., Gardner, J.R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-11T05:58:47.884807Z"},"links":{"citing_paper":"/paper/2412.16970"},"observation_digest":"sha256:5eb3f697fc6a4e887fd5167e58e415df5b6dff6a82da34e03f738c212551c1b8","observation_id":"aae2c005-b93f-4823-a09d-fbfd6c5c1460","resolution":{"observed_at":"2026-08-11T05:58:47.884807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.16970","last_updated":"2025-08-10T19:30:14Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-11T09:50:55.591654Z","submitted_at":"2024-12-22T11:02:13Z","title":"A Research Agenda for Usability and Generalisation in Reinforcement Learning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":98,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":178},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 100 of 178 outbound references and 0 inbound Pith citation observations for arXiv:2412.16970."}