{"as_of":"2026-08-13T01:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0f69aed3e7fac4a35d71345c5dfa8f70098cbebe4378aca4a291e07db0a66121","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:59:14.592755Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-09T14:21:34.002785Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T17:01:05.767124Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"cited_work":{"arxiv_id":"2505.20659","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20659","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"T., Rutherford, A., Goldie, A","venue":null,"work_id":"78235faa-cc10-4053-864b-f06815481c97","year":null},"citing_paper":{"arxiv_id":"2605.01358","last_updated":"2026-05-02T10:07:59Z","snapshot_observed_at":"2026-08-11T03:55:56.953836Z","submitted_at":"2026-05-02T10:07:59Z","title":"PACE: Parameter Change for Unsupervised Environment Design","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-09T14:21:34.002785Z"},"links":{"cited_paper":"/paper/2505.20659","citing_paper":"/paper/2605.01358"},"observation_digest":"sha256:f0e425c6b18649d7ee5996481a0206687589f7b7745d2b19d8f8a1c98fc0daae","observation_id":"403859c4-df78-4cf1-80df-81596663fb5e","resolution":{"observed_at":"2026-05-11T17:01:05.778697Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.20659/citation-record","integrity":"/paper/2505.20659/integrity","json":"/paper/2505.20659/citation-record.json","paper":"/paper/2505.20659"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:19.600777Z","title":"Deep reinforcement learning at the edge of the statistical precipice","venue":null,"work_id":"4af50c9f-3931-41d5-bf05-19be92c64b73","year":2021},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:10.413701Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:57a2ace0968a27f866d284e08916e9a52cd50a4b44d6352e48c3faa02c7bc84a","observation_id":"45ca37ad-4d64-478d-b350-43edcb5d8613","resolution":{"observed_at":"2026-08-07T13:59:19.705091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:19.462204Z","title":"Clutr: curriculum learning via unsupervised task representation learning","venue":null,"work_id":"441a881b-c917-46bc-90b9-40ba6f1b56ce","year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:10.491830Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:a078cd968f85bdfeeb8b9742b890e71aacb09ed9621256a3e4e5a0c0f0553879","observation_id":"ada294b3-89b2-47d5-9b4f-070da3fe9c1a","resolution":{"observed_at":"2026-08-07T13:59:19.546959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:19.299881Z","title":"Refining minimax regret for unsupervised environment design","venue":null,"work_id":"680686b6-761a-4cc2-866f-5404780b9a1a","year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:10.573843Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:bffad0190bac841b3c66fe3fc6332d5bc5298d2a195835ffd256e22d576f7a4b","observation_id":"0cd35d5d-94f9-4ca2-b00e-5b4f1bbc28d6","resolution":{"observed_at":"2026-08-07T13:59:19.421742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:10.649739Z","title":"JAX : composable transformations of P ython+ N um P y programs, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:10.649739Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:a129abd476d3c64f5d7b1ed4d7812d8814e1dd9e5f60769f2dd53c578f70b05f","observation_id":"f8cf8398-e8db-4a6a-a36a-1f2068138495","resolution":{"observed_at":"2026-08-07T13:59:10.649739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:19.146701Z","title":"Accelerated algorithms for constrained nonconvex-nonconcave min-max optimization and comonotone inclusion","venue":null,"work_id":"be68286b-ea8c-4b49-883f-7994d6ad67cf","year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:10.751724Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:3600a8ee60cad5f678eac02168dd34016258d4d106c796bd57f2bfa59b9f1af0","observation_id":"986bd1ea-e823-4651-938b-31815d897e4d","resolution":{"observed_at":"2026-08-07T13:59:19.215057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:18.962935Z","title":"Minigrid &amp; miniworld: Modular &amp; customizable reinforcement learning environments for goal-oriented tasks","venue":null,"work_id":"71ae6f5a-af90-4ea2-ad2e-58d161cf672d","year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:10.814763Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:bcc161b824072152cdd275dfcabb816077875a3e745a730ff37db42adee2cc5b","observation_id":"7734ced4-d71b-46e5-8d30-12d7179bbbb6","resolution":{"observed_at":"2026-08-07T13:59:19.001873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:18.816474Z","title":"Adversarial environment design via regret-guided diffusion models","venue":null,"work_id":"0c405506-7d6e-489a-9d4f-03fd038475dc","year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:10.899420Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:791aa7bf70fde545cde20fe55d1710da10af756379916d71a35e71a70db97e19","observation_id":"69b594fd-67e8-4c20-9c97-21e320e62cb7","resolution":{"observed_at":"2026-08-07T13:59:18.870568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13091","last_updated":"2024-03-19T18:40:50Z","snapshot_observed_at":"2026-08-13T00:50:02.176108Z","submitted_at":"2024-03-19T18:40:50Z","title":"JaxUED: A simple and useable UED library in Jax","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13091","snapshot_observed_at":"2026-08-07T13:59:11.000212Z","title":"Jaxued: A simple and useable ued library in jax, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.000212Z"},"links":{"cited_paper":"/paper/2403.13091","citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:59c3e6552f6256faf5d72e5080cba590674b659283ecaa59b8cb2f0de990542d","observation_id":"c29b49b6-08d9-4c8c-b2ec-db2998b0e4f5","resolution":{"observed_at":"2026-08-07T13:59:11.000212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:11.128688Z","title":"Last-iterate convergence: Zero-sum games and constrained min-max optimization, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.128688Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:8702d62f0f7eabeda22080afeaceb825a007fd1686e3adedfe432c03fc6467e5","observation_id":"944f8ce6-0429-4135-98dd-126f720c94a2","resolution":{"observed_at":"2026-08-07T13:59:11.128688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:18.706540Z","title":"Emergent complexity and zero-shot transfer via unsupervised environment design","venue":null,"work_id":"dc4cd217-de41-42d0-9111-3e70193937c9","year":2020},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.214362Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:270aacb5fa25d6dc5f6509b0cf5de5adf5bd96379bbb8ab3dcbe50995b872635","observation_id":"9fda1768-f0a8-43b4-8653-e35690083741","resolution":{"observed_at":"2026-08-07T13:59:18.752437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:18.555565Z","title":"Lucas, and Stefano V","venue":null,"work_id":"795b05b2-fafb-4ae2-b437-bce2fbf974b7","year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.324172Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:908897b9a711fdc9d24eda0b8295d1218282783bf28993d72cf23333448ed72d","observation_id":"5c41e082-7c63-4c14-b160-ebe0f672ed9c","resolution":{"observed_at":"2026-08-07T13:59:18.623243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:18.407995Z","title":"Mirror learning: A unifying framework of policy optimisation","venue":null,"work_id":"573d4ff9-c877-4254-babd-a779d541a493","year":2022},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.429144Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:7b81a73050c7072c1f0840d8443243f703f6d39204b96e744573f7c833ee3d64","observation_id":"c6b2672d-dce6-4994-9582-096f264228e0","resolution":{"observed_at":"2026-08-07T13:59:18.506970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:11.517105Z","title":"A two-timescale stochastic algorithm framework for bilevel optimization: Complexity analysis and application to actor-critic","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.517105Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:6cf4dd9a4f13e811364f1dbf36394c0d9d8a183e0651a34315f7039f39ec5f1c","observation_id":"51a42f59-85a3-4c36-97e9-7cd76d272abc","resolution":{"observed_at":"2026-08-07T13:59:11.517105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:18.261954Z","title":"Replay-guided adversarial environment design","venue":null,"work_id":"58ee943a-d994-404b-96d9-244e278fedc0","year":2021},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.622907Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:274c5113c59ba87b9c939cbf8f972ba329a5fd1563131acc58c4936de6b4962f","observation_id":"d948ca9a-e2ed-421d-abbf-ce71266722d3","resolution":{"observed_at":"2026-08-07T13:59:18.336846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:18.035952Z","title":"Prioritized level replay","venue":null,"work_id":"041eee7b-de71-4a4f-a6e0-992c09869dcf","year":2021},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.724621Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:85e204d0402eaa79303d588f718779df2fe16d1e92a908f13eceb57d3afac2df","observation_id":"2e041ef6-932d-4fb3-aba4-2147f2babde1","resolution":{"observed_at":"2026-08-07T13:59:18.130563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:17.823611Z","title":"u ttler, Edward Grefenstette, Tim Rockt\\","venue":null,"work_id":"f17ebe67-dcfc-4265-ba8c-f6cda6ae64fb","year":2022},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.831003Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:887039f4332631576d1bd6004e177bda11369363f1248f871ca2ee10f8675edb","observation_id":"d15ce4fa-db3d-49a0-a718-834ea5440add","resolution":{"observed_at":"2026-08-07T13:59:17.925056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:17.603225Z","title":null,"venue":null,"work_id":"8c0f6690-c83e-4cfe-8f23-e8894a639249","year":2020},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.922187Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:6238a9b231b5e6074a4f1511d2dc3b86ace05e91a2ab7099146076aabd96c23c","observation_id":"92c27f9c-b253-4fd8-8571-b5e342984f7c","resolution":{"observed_at":"2026-08-07T13:59:17.718011Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:17.364196Z","title":"Learning equilibria in adversarial team markov games: A nonconvex-hidden-concave min-max optimization problem","venue":null,"work_id":"7488af14-d4e5-40c5-bffb-1029a02c7b09","year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.010761Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:9679e9e9a87ad3c991b6fc0faf670ee5fa62fa9d4fb59b93326c6a05d6e45a79","observation_id":"d27827ae-fc16-486a-a107-775f5a4c34ca","resolution":{"observed_at":"2026-08-07T13:59:17.478131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T13:59:12.133909Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.133909Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:eba9f644c4b8f22924e0765427cd0dcbb9d6d8a4a55a14aeb56a345ed0e29c51","observation_id":"f16aeca1-a981-4b65-b472-4dcc732060dc","resolution":{"observed_at":"2026-08-07T13:59:12.133909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:17.180392Z","title":"Last iterate convergence in no-regret learning: constrained min-max optimization for convex-concave landscapes","venue":null,"work_id":"8860e495-a27c-4af5-a844-68f7d5aa490c","year":2021},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.233330Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:655d475892e47d70c67f99005722fee9914f69a68556a1e38908d677b482e07d","observation_id":"9a288aa5-d2e6-4cad-9d1d-6aba6953f1e1","resolution":{"observed_at":"2026-08-07T13:59:17.259025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00301","last_updated":"2024-02-15T07:12:14Z","snapshot_observed_at":"2026-07-06T16:25:54.621792Z","submitted_at":"2023-09-30T08:21:32Z","title":"Enhancing the Hierarchical Environment Design via Generative Trajectory Modeling","version":2},"cited_work":{"arxiv_id":"2310.00301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.00301","snapshot_observed_at":"2026-08-07T13:59:15.071520Z","title":"Enhancing the Hierarchical Environment Design via Generative Trajectory Modeling","venue":"cs.LG","work_id":"af55dba8-df36-48bd-8077-74fd6e801a32","year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.378628Z"},"links":{"cited_paper":"/paper/2310.00301","citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:6652ccf1aed46d86dd0dc01b37e67299ce72c35b97f8788ee59b96c9da8ef7e5","observation_id":"ae1812bc-2a81-46ee-878a-c0d69fca5952","resolution":{"observed_at":"2026-08-07T13:59:15.104332Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.983012Z","title":"Tiada: A time-scale adaptive algorithm for nonconvex minimax optimization","venue":null,"work_id":"1d2a10be-ffd7-4f4c-ac5e-9e254ea7e3df","year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.463315Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:eb3869b631f97c6b14c915c6b2f199090ed7566bfc27d33d509eb706670a48bd","observation_id":"129197d0-3282-4dce-a945-3e419beb864b","resolution":{"observed_at":"2026-08-07T13:59:17.070894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.837203Z","title":"On gradient descent ascent for nonconvex-concave minimax problems","venue":null,"work_id":"6706cde5-02e5-4f18-851d-0da319dcafc7","year":2020},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.572294Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:c752de516ffd5ce80104431ccf416ddbcc24199ad0248e66fe9e176de78d0282","observation_id":"f0b11906-d612-46ff-960d-ce38d447c9d0","resolution":{"observed_at":"2026-08-07T13:59:16.918490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.685566Z","title":"Craftax: A lightning-fast benchmark for open-ended reinforcement learning","venue":null,"work_id":"eba91d50-fe14-4836-9d20-aabe966a84c7","year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.644949Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:8aec18be9734d4458568ce72c1cf6b41c951e734cb2ca41ce37b73f41eaafa69","observation_id":"cc0f33ef-84da-45c4-9a50-d6f8762473bc","resolution":{"observed_at":"2026-08-07T13:59:16.732021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.581879Z","title":"Kinetix: Investigating the training of general agents through open-ended physics-based control tasks","venue":null,"work_id":"381c9fae-0815-47a1-b98c-127117923f90","year":2025},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.752204Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:f495b8851a1159650f6051b8870c8dd6119ceaf22e1f90d19f16254b13a7f2c2","observation_id":"70cb860c-feca-41ff-820f-a284257be5b9","resolution":{"observed_at":"2026-08-07T13:59:16.626931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.438711Z","title":"Optimistic mirror descent in saddle-point problems: Going the extra(-gradient) mile","venue":null,"work_id":"9e9e20ae-c032-42cc-a446-b245f8fa1336","year":2019},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.854877Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:81d481a51979970b4d09fa63aa131e10b62df9e271fbc389c5e812bc4c5036d4","observation_id":"66de8767-e7ae-4c2d-8a51-5e66d11f0a1a","resolution":{"observed_at":"2026-08-07T13:59:16.494263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.311306Z","title":"Stable recurrent models","venue":null,"work_id":"eaf966ec-85b6-42a6-8020-d068fcaaa341","year":2019},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.990050Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:4981e9ba4cded81c773b2dd514c2e997eec7c20b1dbfc2d8fed1882abcaf8207","observation_id":"5e02fc73-c8e4-49e1-9a07-b54e5a9f27c9","resolution":{"observed_at":"2026-08-07T13:59:16.372486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.164362Z","title":"Robust reinforcement learning","venue":null,"work_id":"592a29b7-00eb-4f0d-9ae1-12fdb58235f6","year":2000},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.093375Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:96112375850b3801cf18e2f1ff6a450b1fec853ffe3f6c1ac4883d5ba666d09c","observation_id":"ed87f572-e213-491f-8bed-5f4f9e76b884","resolution":{"observed_at":"2026-08-07T13:59:16.237568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.049686Z","title":null,"venue":null,"work_id":"1f67c8b3-3007-4c2b-adf3-0376ae922340","year":1951},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.224898Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:58cbfef9f5fa36cabe444fd74721ab41d0bf077fd9232c60f1ea4ff1c6d095a5","observation_id":"f2683a6a-ecf0-4633-972b-a007f7d9e3f7","resolution":{"observed_at":"2026-08-07T13:59:16.114373Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:13.352186Z","title":"XL and-minigrid: Scalable meta-reinforcement learning environments in JAX","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.352186Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:83aa58bd8b3145877069948e5b32d5499ba6d537d3b70b297c9092fc1e2356a1","observation_id":"0695a52a-79a8-4f20-855b-4449848915e1","resolution":{"observed_at":"2026-08-07T13:59:13.352186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:15.906756Z","title":"Solving a class of non-convex min-max games using iterative first order methods","venue":null,"work_id":"52c73026-6144-4907-9d1e-b2ea0482153f","year":2019},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.450648Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:2816e5aa9eed73885f5b3353e9cfdf2fe2f059b70265932168cba7b6968ce7c8","observation_id":"6a374c7d-daa1-4782-b1ec-6927331f77f5","resolution":{"observed_at":"2026-08-07T13:59:15.957737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.01302","last_updated":"2023-09-30T18:36:42Z","snapshot_observed_at":"2026-07-06T12:43:24.521815Z","submitted_at":"2022-03-02T18:40:00Z","title":"Evolving Curricula with Regret-Based Environment Design","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.01302","snapshot_observed_at":"2026-08-07T13:59:13.547382Z","title":"Evolving curricula with regret-based environment design, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.547382Z"},"links":{"cited_paper":"/paper/2203.01302","citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:fe47382640027afa46d9051277e5c8811f5ec88596302d242d3ad365381691c8","observation_id":"0aaa8f87-43d4-449f-96c1-75f18f280b62","resolution":{"observed_at":"2026-08-07T13:59:13.547382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v33i01.33014739","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Robust optimization over multiple domains","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"d1ed99cd-5a4e-4f8c-93f5-97ea918f4df8","year":2019},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.643777Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:14b0f954f6d1dc281f3ad4c47cfa1762e762dabdb6c3121936df587ac1b5cb29","observation_id":"8167e1a4-a411-4579-8cd3-2046172a8ce5","resolution":{"observed_at":"2026-08-07T13:59:14.766577Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:15.784775Z","title":"No regrets: Investigating and improving regret approximations for curriculum discovery","venue":null,"work_id":"71fd9066-9e79-4966-8ee9-a87fe5727612","year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.739015Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:6210f13420171104258881711c8cdb58dd14621fbad69b14e719a22d0afe67db","observation_id":"d5a5d92c-dfd3-4037-a06c-ddcb3e253e99","resolution":{"observed_at":"2026-08-07T13:59:15.839939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T13:59:13.887358Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.887358Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:441e35bb05787db95a3ad3a601f6b8a2fe356f0ea8da37c29173f535fa070a85","observation_id":"63983b9c-3285-4557-869d-4ade299788cf","resolution":{"observed_at":"2026-08-07T13:59:13.887358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:15.678251Z","title":"Hessian aided policy gradient","venue":null,"work_id":"7e05fd9e-71e5-49ae-962e-50245bb49db2","year":2019},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.973152Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:ef08e07e759c8ccce308091b4f45c0434441419e28386f708d3d1d855b31994c","observation_id":"d39efadf-3ba4-4e3b-b733-65fad7461315","resolution":{"observed_at":"2026-08-07T13:59:15.717329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:14.059351Z","title":"Domain randomization for transferring deep neural networks from simulation to the real world","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:14.059351Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:afe88aa9d5b9a8564551845cde395b745151cf0f869b2bd6467289f6c8420748","observation_id":"3075b3c5-cab8-480a-8875-0fc3b7e313cb","resolution":{"observed_at":"2026-08-07T13:59:14.059351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:15.522625Z","title":"P roximal C urriculum for R einforcement L earning A gents","venue":null,"work_id":"889ad8e6-64d7-4dc6-b711-af1af713f952","year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:14.155579Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:f9e349f8a5d79194f1c6bd70f36465b45ca65e860e2e41de4bf2a83ecabd252e","observation_id":"581c788d-a6a1-4de2-8341-95af4d932f51","resolution":{"observed_at":"2026-08-07T13:59:15.595700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:15.419361Z","title":"Lipschitz regularity of deep neural networks: analysis and efficient estimation","venue":null,"work_id":"a77db14c-4b32-4cea-8c1f-2dd338009197","year":2018},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:14.299763Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:79190c8234f5e4f2ba1b9d675aa5169d6f18371a8ae99b23d602834c6f35f578","observation_id":"85d3e82b-1fa0-4282-a736-f1286aceaa78","resolution":{"observed_at":"2026-08-07T13:59:15.458707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00927","last_updated":"2020-03-24T20:16:02Z","snapshot_observed_at":"2026-08-04T18:37:52.241290Z","submitted_at":"2019-09-30T00:27:08Z","title":"Stabilizing Generative Adversarial Networks: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.00927","snapshot_observed_at":"2026-08-07T13:59:14.404004Z","title":"Albrecht, and Andrew Nystrom","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:14.404004Z"},"links":{"cited_paper":"/paper/1910.00927","citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:c0cc4a00229789a8892db7756dd2012e10d0878219f4f88287a301d2079cc47f","observation_id":"7bf159ea-5053-4b73-86c9-d215858e5636","resolution":{"observed_at":"2026-08-07T13:59:14.404004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:14.514957Z","title":"Williams","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:14.514957Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:81fb4afce4f4e157588c2334cc773a575eac767e202f9480a74a423e0e4603ff","observation_id":"c8e08809-0025-43f7-90cb-dab3fb946529","resolution":{"observed_at":"2026-08-07T13:59:14.514957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:14.592755Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:14.592755Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:2abcb581bf3e570d3b223266502b4662e67853597e15ec2e3cc8d445c8fc349a","observation_id":"55eebba2-f222-4ffd-a331-6b6d473f3c27","resolution":{"observed_at":"2026-08-07T13:59:14.592755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T21:14:10.190424Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":2,"verified_fuzzy":26},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2505.20659."}