{"as_of":"2026-08-19T00:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6936bd0d5f3bcd5794f913597668a7a121af22bfcb39f025fe777ee2583a7697","coverage":[{"denominator":100,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T06:07:19.785138Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.19139/citation-record","integrity":"/paper/2504.19139/integrity","json":"/paper/2504.19139/citation-record.json","paper":"/paper/2504.19139"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.454225Z","title":"Sharp-maml: Sharpness-aware model-agnostic meta learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.454225Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:e6efac0ce81b882dc9c808404b03c9b4ce51bba53a54f530a5082309e6c22201","observation_id":"09e1139d-b60f-407b-8b04-691ecdb6c77c","resolution":{"observed_at":"2026-08-16T06:07:19.454225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1205.2664","last_updated":"2012-05-09T14:42:20Z","snapshot_observed_at":"2026-08-15T04:10:23.408004Z","submitted_at":"2012-05-09T14:42:20Z","title":"A Bayesian Sampling Approach to Exploration in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1205.2664","snapshot_observed_at":"2026-08-16T06:07:19.458774Z","title":"L., Nouri, A., and Wingate, D","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.458774Z"},"links":{"cited_paper":"/paper/1205.2664","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:6d5ff4e0c5c08dd4f9029f0ad5f9015b410adc6a96e780d0ab12e1cf7855dc63","observation_id":"a7338292-d05e-4a24-9bbc-194edf99542e","resolution":{"observed_at":"2026-08-16T06:07:19.458774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.462707Z","title":"Finite-time analysis of the multiarmed bandit problem, 2002 a","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.462707Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:a0e34f4143effa1453f57d51a0c169f9a79c43cfa3a517345d94a75ddcdb311a","observation_id":"f3958e16-e579-48bd-a001-efba37863483","resolution":{"observed_at":"2026-08-16T06:07:19.462707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.466308Z","title":"Using confidence bounds for exploitation-exploration trade-offs","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.466308Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:148e720c6ba8159b458512adb1b47e9e49004dd0a93ab3076193554c2cde3393","observation_id":"a9393637-ad10-475d-b595-a2952282abb0","resolution":{"observed_at":"2026-08-16T06:07:19.466308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-18T14:02:27.816186Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-16T06:07:19.469725Z","title":"Z., Xiong, Z., Zintgraf, L., Finn, C., and Whiteson, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.469725Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:6a2e0146f8cc9e8950cb1bd2fabea6ef6ecd4176d782a3dca3b423dfe210dbd6","observation_id":"88de1a95-ef77-40c5-a89c-ebfc37edfea0","resolution":{"observed_at":"2026-08-16T06:07:19.469725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.473581Z","title":"C., and Ye, Y","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.473581Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:8b64b4fc77a2fb38889f8245fb23029e993a7fcf445493f13d26d91d1fd1510b","observation_id":"1b58aae1-a71b-435b-941b-1b2545c4c55f","resolution":{"observed_at":"2026-08-16T06:07:19.473581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.477281Z","title":"C., and Jordan, M","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.477281Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:18c87bfed47c082d39d2e61b68efb56715ccfe5550b2ddc66c0fc48cb51e9dc3","observation_id":"db0e3d95-27dc-4f8f-9028-b0b522d7e5ba","resolution":{"observed_at":"2026-08-16T06:07:19.477281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.06705","last_updated":"2019-02-20T17:38:32Z","snapshot_observed_at":"2026-08-14T17:14:47.799958Z","submitted_at":"2019-02-18T18:18:27Z","title":"On Evaluating Adversarial Robustness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.06705","snapshot_observed_at":"2026-08-16T06:07:19.480792Z","title":"On evaluating adversarial robustness","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.480792Z"},"links":{"cited_paper":"/paper/1902.06705","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:cf056856ccc339e3c6f44c5aac6fcfebea35bfdad49d2eaf1257fd60c94b443f","observation_id":"09bf18a0-b6c5-4008-b68c-004d67679998","resolution":{"observed_at":"2026-08-16T06:07:19.480792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.484656Z","title":"and Valko, M","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.484656Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:fb894c6831ab2725e48336749dd6c40b66835550bf7699e95ba6ab3de84b462d","observation_id":"e9d098ea-8a69-4c04-959b-5272c941ddc2","resolution":{"observed_at":"2026-08-16T06:07:19.484656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.487852Z","title":"Risk aversion in finite markov decision processes using total cost criteria and average value at risk","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.487852Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:80168bf4fa845a070b54b8cdff3c68a7033c7c80da4e995eed88749d8f4fea84","observation_id":"084e88be-a8f7-4f9b-84ec-5a9d8acf0de6","resolution":{"observed_at":"2026-08-16T06:07:19.487852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.490989Z","title":"Box2d: A 2d physics engine for games, 2007","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.490989Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:596d4f326b37c4374bd47a7ff3957b2cddbe23c2a521d0a78b3456b15d1774d3","observation_id":"ee3a6edc-370d-40bb-91bf-9252012b9bba","resolution":{"observed_at":"2026-08-16T06:07:19.490989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.493963Z","title":"Tohan: A one-step approach towards few-shot hypothesis adaptation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.493963Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:7094bd131309417b2173694bf5e30ddb431da42e600ab1032efd12043963859e","observation_id":"5aa9a946-f255-45e9-9c9d-39b50762b71c","resolution":{"observed_at":"2026-08-16T06:07:19.493963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.497136Z","title":"Unveiling causal reasoning in large language models: Reality or mirage? Advances in Neural Information Processing Systems, 37: 0 96640--96670, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.497136Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:eb86a4804a65d7aa27ecf73add0f9c623225e841a22b34dfa2f2038868829ace","observation_id":"10390f7b-7b0d-4a0a-82da-9448cc321188","resolution":{"observed_at":"2026-08-16T06:07:19.497136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.500290Z","title":"Does confusion really hurt novel class discovery? International Journal of Computer Vision, 132 0 (8): 0 3191--3207, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.500290Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:9cf4e4f18e39bf4b828feac51913cbee758579eaa526fd51812469aec88cd1ec","observation_id":"5ae36d18-d5c2-4ac7-a337-b1d2f9fa7f17","resolution":{"observed_at":"2026-08-16T06:07:19.500290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.503511Z","title":"Risk-sensitive and data-driven sequential decision making","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.503511Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:605a426dadbfd99e5acd1f7c7e1cbee24f7479ac34f7d0e2ea1f99ce2201fa3e","observation_id":"5a52b742-1efd-446d-9d0c-e764011016c3","resolution":{"observed_at":"2026-08-16T06:07:19.503511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.506792Z","title":"Risk-sensitive and robust decision-making: a cvar optimization approach","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.506792Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:08453c1bfe622cc567edba323decf3b0219a7f3cd757b366838bb32c3eeb7768","observation_id":"d48cba5d-a026-457d-bfcf-fbdb0540a6a3","resolution":{"observed_at":"2026-08-16T06:07:19.506792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.510159Z","title":"Risk-constrained reinforcement learning with percentile risk criteria","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.510159Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:af4387981f97bb0eabefac466ae454b267bd947dcab8b2ad03105c5aafa1c046","observation_id":"3d165292-de38-4999-ac7a-796108c24444","resolution":{"observed_at":"2026-08-16T06:07:19.510159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.513287Z","title":"Safe policy learning for continuous control","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.513287Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:9036df24fda20ed0c458b05780435f295d9a78d4eb9df4530ebef76e95b1538e","observation_id":"08b77fd6-6cf0-4907-8477-1097cdfaff34","resolution":{"observed_at":"2026-08-16T06:07:19.513287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.516464Z","title":"A., Ghahramani, Z., and Jordan, M","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.516464Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:337c99333e03251742bd9eb2c3ae40b595d34a46e4507ee03104357025b59e0f","observation_id":"ad555537-0d1a-4d8e-85dd-5c9e0045ab09","resolution":{"observed_at":"2026-08-16T06:07:19.516464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.519552Z","title":"Task-robust model-agnostic meta-learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.519552Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:af6e5d55433078aaf24b9dbc3d0564d9e23842ff41e676b1794a89e2d4efa9ea","observation_id":"520db437-9c7b-45ba-a628-5fb89d6311fd","resolution":{"observed_at":"2026-08-16T06:07:19.519552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.522707Z","title":"Bullet physics simulation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.522707Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:8fb4bb07bf8020d3d8ab9f932d638879022bace3e263be65295a622e7c42db42","observation_id":"2f599618-15bf-4f0a-b9e9-82c98d327771","resolution":{"observed_at":"2026-08-16T06:07:19.522707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.525933Z","title":"Emergent complexity and zero-shot transfer via unsupervised environment design","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.525933Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:67095e313e4bc7052a9677c7e3f5755b7c72a613bbb957510d2dea75d733b2b7","observation_id":"cfb1dac3-b75c-4f21-841a-4174aca1c1e3","resolution":{"observed_at":"2026-08-16T06:07:19.525933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.02779","last_updated":"2016-11-10T01:17:36Z","snapshot_observed_at":"2026-08-14T21:31:19.001119Z","submitted_at":"2016-11-09T00:13:29Z","title":"RL$^2$: Fast Reinforcement Learning via Slow Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.02779","snapshot_observed_at":"2026-08-16T06:07:19.529048Z","title":"L., Sutskever, I., and Abbeel, P","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.529048Z"},"links":{"cited_paper":"/paper/1611.02779","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:217e966135e467248731c4d361bc274328f9e0df3622d15f46ce81e047680951","observation_id":"c7dbbb5e-b488-41c1-91c5-920cb78e1cc4","resolution":{"observed_at":"2026-08-16T06:07:19.529048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.532581Z","title":"Model-agnostic meta-learning for fast adaptation of deep networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.532581Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:2b8c8399b0037e7fd30df598562d25d2abdb722d71d95afbe13f464ee7581ccb","observation_id":"0bf6c1c1-77c8-416d-8117-80618e674125","resolution":{"observed_at":"2026-08-16T06:07:19.532581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.583887Z","title":"Probabilistic model-agnostic meta-learning","venue":null,"work_id":"926c61a3-2805-4d30-b45c-d47ce4d7fd2f","year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.535863Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:71437e6d3017dc0a6de01bc0afdb309b066fd23230f98ce226faf918fe4b2adf","observation_id":"4ba7b02f-826c-411a-a9fd-26ad116d33db","resolution":{"observed_at":"2026-08-16T06:07:20.587274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.539079Z","title":"Addressing function approximation error in actor-critic methods","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.539079Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:07ad16215888bb89ddae23e815ac6b5dfa859131be81721eae51ca6699080e0d","observation_id":"3e10efdc-50e3-4987-acf9-069324e04e40","resolution":{"observed_at":"2026-08-16T06:07:19.539079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.542165Z","title":"Deep bayesian active learning with image data","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.542165Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:9585e2f2c392f0c085613418dbb5b922ea91ad9dffba2f249099c372d2246c12","observation_id":"73b4ff04-48e1-4b27-bccc-7b3ad2b1462c","resolution":{"observed_at":"2026-08-16T06:07:19.542165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"0805.3415","last_updated":"2008-05-22T09:18:44Z","snapshot_observed_at":"2026-08-16T18:59:25.396218Z","submitted_at":"2008-05-22T09:18:44Z","title":"On Upper-Confidence Bound Policies for Non-Stationary Bandit Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"0805.3415","snapshot_observed_at":"2026-08-16T06:07:19.545422Z","title":"and Moulines, E","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.545422Z"},"links":{"cited_paper":"/paper/0805.3415","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:f8710e7080a7d210ee2cfa35e5f59e0b3c1548b603db61ef7f77e7871d5394ba","observation_id":"c013a9d6-e318-4622-9214-ca36fda4c9c0","resolution":{"observed_at":"2026-08-16T06:07:19.545422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.01622","last_updated":"2018-07-04T14:49:46Z","snapshot_observed_at":"2026-08-14T18:55:44.864275Z","submitted_at":"2018-07-04T14:49:46Z","title":"Neural Processes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.01622","snapshot_observed_at":"2026-08-16T06:07:19.549045Z","title":"J., Eslami, S., and Teh, Y","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.549045Z"},"links":{"cited_paper":"/paper/1807.01622","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:7bbebd6c6c434b4736defa9a63225211dd5fe6a0a95b88d2bc12c1cece16cb30","observation_id":"39d67b2e-5b1a-4a58-8bd8-dbf2cecdf521","resolution":{"observed_at":"2026-08-16T06:07:19.549045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.552344Z","title":"W., Gast, J., Ruiz, I","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.552344Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:adf5df8b6fd3355904bd6e81f8f01c490bfe514992ab0ab32db7e2c83122acb9","observation_id":"db9426d3-cb51-49c4-bda5-bc3087bb20c4","resolution":{"observed_at":"2026-08-16T06:07:19.552344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.555550Z","title":"Efficient risk-averse reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.555550Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:ad5f5e3bd718ae4e7e96da899eae897b8fb4ba4e6450c9a0c834220c6b6ee4ae","observation_id":"ecc75b9d-4c65-4272-868a-e61485fe8737","resolution":{"observed_at":"2026-08-16T06:07:19.555550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.550675Z","title":"Train hard, fight easy: Robust meta reinforcement learning","venue":null,"work_id":"2565dcc4-65e9-4c04-a8d4-60b34d54f25c","year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.558873Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:e57ec108db22a8c7be928743e5c04e44155eb9956737f2eda7cb5d7d876ebe53","observation_id":"e8b401d3-9702-4d82-bef4-917a36cf50af","resolution":{"observed_at":"2026-08-16T06:07:20.553993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.540543Z","title":"Meta-reinforcement learning of structured exploration strategies","venue":null,"work_id":"4776a4d5-504b-4eef-a749-d370d69eb232","year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.562580Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:1e0cb84f35214e3b814c62b5c484bcb8a6c50f46033a3565be36e72638ec8fec","observation_id":"72f301d9-fb70-4907-b8f6-859b32073cea","resolution":{"observed_at":"2026-08-16T06:07:20.544201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.529936Z","title":"Beyond uniform sampling: Offline reinforcement learning with imbalanced datasets","venue":null,"work_id":"6d13ecf1-06df-4519-b440-79c0df09011c","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.565645Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:6150069291240b35f0705c467c696f330ba524cd9cccc02fa02d9bbd3c761967","observation_id":"8809c028-b3aa-4805-b1b9-8c5a26198c5d","resolution":{"observed_at":"2026-08-16T06:07:20.533631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.568751Z","title":"Meta-learning in neural networks: A survey","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.568751Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:043a5d368e13c6551b8e6ef58e5853319d3582fcd40e30b0949c969c1ad4995a","observation_id":"a6e17ffc-edd1-4c2a-8251-2376183c8832","resolution":{"observed_at":"2026-08-16T06:07:19.568751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.514368Z","title":"Replay-guided adversarial environment design","venue":null,"work_id":"fd28fdfd-4f1b-440f-8f39-ab08a791eb10","year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.571839Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:222b9095d9e0e0cbaf09c871a1357999cb4a0c328f03748c74ea530eb460db89","observation_id":"f92a9204-8118-4b48-8ea2-1ee27e65fead","resolution":{"observed_at":"2026-08-16T06:07:20.517773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-16T06:07:19.575103Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.575103Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:18a1c3fcb53b9f9ec111fda2309d3f1d31efed7f9bb334540fa0130a50fa6f39","observation_id":"848061a3-a3bb-463d-ba5f-2ee24d7fc1a3","resolution":{"observed_at":"2026-08-16T06:07:19.575103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.503833Z","title":"Batchbald: Efficient and diverse batch acquisition for deep bayesian active learning","venue":null,"work_id":"725d01e2-e9e7-423b-9a6b-329ae9a89498","year":2019},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.578658Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:df9011ef3f86cdf5c1f9d6d34ed830c324b1edaf88d9e9e8941ef4720c2aa4d1","observation_id":"8b2b7e8e-e1f6-42e9-bbe1-db88d8b52e17","resolution":{"observed_at":"2026-08-16T06:07:20.507713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.581994Z","title":"W., Sagawa, S., Marklund, H., Xie, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.581994Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:3eab884afd09c5fa07c2983666a7be87cd327e0356af2c891252416e12e09e6c","observation_id":"40efd838-94f0-4597-b41c-b036314ff133","resolution":{"observed_at":"2026-08-16T06:07:19.581994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.487483Z","title":"D., Jansen, N., and Topcu, U","venue":null,"work_id":"4e80ea81-3e44-400d-afee-9f2d786060ae","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.585184Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:f160872c0dd51487a40797fca82396a4374af5ebcdfc5c4fe78e9b3ccea81789","observation_id":"628fe51d-540b-4f10-82bd-dba56e076eb1","resolution":{"observed_at":"2026-08-16T06:07:20.491172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-16T06:07:19.588739Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.588739Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:dda4344281b5b86fa3bf199e9cbcff1d869e44aeccfa6c899743d38df0075bc8","observation_id":"36d99476-cedd-4c8e-be10-4f532acf5e6f","resolution":{"observed_at":"2026-08-16T06:07:19.588739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.01112","last_updated":"2021-05-06T09:06:50Z","snapshot_observed_at":"2026-08-18T21:10:08.842386Z","submitted_at":"2020-10-02T17:13:39Z","title":"FOCAL: Efficient Fully-Offline Meta-Reinforcement Learning via Distance Metric Learning and Behavior Regularization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.01112","snapshot_observed_at":"2026-08-16T06:07:19.592312Z","title":"Focal: Efficient fully-offline meta-reinforcement learning via distance metric learning and behavior regularization","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.592312Z"},"links":{"cited_paper":"/paper/2010.01112","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:2ff78a020b336ce89c63f55fa57d78f20c78590fcb5d703cbbdf7d6c9bc9875b","observation_id":"181ab4fc-e272-40ef-9092-d7ec4a0f3549","resolution":{"observed_at":"2026-08-16T06:07:19.592312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.477056Z","title":null,"venue":null,"work_id":"0ed76706-b730-48ec-a928-61448f4d284c","year":2000},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.595751Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:3beb1f906155672ce24c95fa242a7a725c8358c0ec3b4ab47c21d678ebf36e5f","observation_id":"211c40b9-32db-49a9-b287-3d629f91d480","resolution":{"observed_at":"2026-08-16T06:07:20.480834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.466329Z","title":"Theoretical investigations and practical enhancements on tail task risk minimization in meta learning","venue":null,"work_id":"fe11c6ac-82f0-45e4-9a93-8eb8c72be5fa","year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.598914Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:4134eebb9b0b98eb846d98087cd189bfaa732b217dcbbfa91a236adc0c15fe0d","observation_id":"59bbb7de-cfa1-4f46-b92c-7bfc49fc81bb","resolution":{"observed_at":"2026-08-16T06:07:20.469952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01967","last_updated":"2024-06-04T04:53:05Z","snapshot_observed_at":"2026-08-18T08:46:45.882264Z","submitted_at":"2024-06-04T04:53:05Z","title":"DrEureka: Language Model Guided Sim-To-Real Transfer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01967","snapshot_observed_at":"2026-08-16T06:07:19.602087Z","title":"J., Liang, W., Wang, H.-J., Wang, S., Zhu, Y., Fan, L., Bastani, O., and Jayaraman, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.602087Z"},"links":{"cited_paper":"/paper/2406.01967","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:756581a262ceb9e920a93fb7e246a0964b118dce8727057d3e53b6ef40671ac2","observation_id":"37f86d4f-c7ec-4872-b1b3-e52a5dfa7ce8","resolution":{"observed_at":"2026-08-16T06:07:19.602087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.605532Z","title":"and Teneketzis, D","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.605532Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:88ee69ddaefd4549a79a2eac7e9fb9233978547a1946634b02842480d887dcfc","observation_id":"932ccd72-ef9f-4421-85aa-dc657993df71","resolution":{"observed_at":"2026-08-16T06:07:19.605532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.450529Z","title":"Supported value regularization for offline reinforcement learning","venue":null,"work_id":"5e33dd12-4a11-41b0-a6c6-73749253ddf6","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.609039Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:467b045c089c3d475a777d423fc5ed313c62b810dc14e78475071257efa5866f","observation_id":"5bd5de1a-bfa4-409b-8ba8-171371fcb1a5","resolution":{"observed_at":"2026-08-16T06:07:20.453803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.440332Z","title":"Supported trust region optimization for offline reinforcement learning","venue":null,"work_id":"2dff6464-2205-45c3-830b-74d02f78f13a","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.612323Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:c1ed5f2ba7789c5564eb8887ccfa2312e7aec383035e95dc2a18c495340af5d9","observation_id":"08e8b828-7914-4b44-9625-d7ed06d336af","resolution":{"observed_at":"2026-08-16T06:07:20.443745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19400","last_updated":"2024-11-01T07:20:10Z","snapshot_observed_at":"2026-08-18T08:49:07.591322Z","submitted_at":"2024-10-25T09:01:37Z","title":"Offline Reinforcement Learning with OOD State Correction and OOD Action Suppression","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19400","snapshot_observed_at":"2026-08-16T06:07:19.615567Z","title":"Offline reinforcement learning with ood state correction and ood action suppression","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.615567Z"},"links":{"cited_paper":"/paper/2410.19400","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:d6379eda0a23a9f44e6cf955556b5f07762a28d7fd07adc3971635f6051b534d","observation_id":"8d134177-3bb4-4deb-9dae-a8b253696e41","resolution":{"observed_at":"2026-08-16T06:07:19.615567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07934","last_updated":"2024-11-13T06:34:07Z","snapshot_observed_at":"2026-08-18T08:49:09.638206Z","submitted_at":"2024-11-12T17:04:56Z","title":"Doubly Mild Generalization for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2411.07934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.07934","snapshot_observed_at":"2026-08-16T06:07:19.964570Z","title":"Doubly Mild Generalization for Offline Reinforcement Learning","venue":"cs.LG","work_id":"aac73140-34b2-4879-a2a1-471cfb65ebfb","year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.619155Z"},"links":{"cited_paper":"/paper/2411.07934","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:963080bfe1f274ec08273f67b48f26f7d73f385496b3c2f236c2f2f5d8632c49","observation_id":"a3552b7b-4a38-43e3-a0c6-812e1ea38396","resolution":{"observed_at":"2026-08-16T06:07:19.968776Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.622708Z","title":"J., and Paull, L","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.622708Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:6efc5f1ba089db9254a55c5265d5761a3a7ad4ba4571ebc92ccd484eaea2da24","observation_id":"6315d687-cfaa-4d1e-bf3b-f147cf91b0ee","resolution":{"observed_at":"2026-08-16T06:07:19.622708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.424376Z","title":"H., and Gal, Y","venue":null,"work_id":"af4e1325-2b3b-47ee-a852-cba69fd0a907","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.625944Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:ca24e9d8387672d0caa59d5ad25cbfecfa763dd5c0b5aa6b8a83b611cfd41ebc","observation_id":"7ae5c00f-4e86-45e3-ba3f-be12b02d81ce","resolution":{"observed_at":"2026-08-16T06:07:20.427747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.414278Z","title":"Domain randomization for simulation-based policy optimization with transferability assessment","venue":null,"work_id":"10a9fde1-d6e9-4479-9011-49e96bd38ee0","year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.629250Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:18fb48fea6ba67ddfbc75295d3064358f82639312caf1e4ea37d07b972432e2e","observation_id":"8cbba36c-a336-4627-a8be-834454a72db0","resolution":{"observed_at":"2026-08-16T06:07:20.417889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.404266Z","title":"Data-efficient domain randomization with bayesian optimization","venue":null,"work_id":"e950b0b8-ef34-422c-9c23-d87ecab13e74","year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.632665Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:8dbbba517c67f81fd29841a4fa94506cc0b1b582551728283c3973d9bf49115f","observation_id":"01d74f5d-c795-4de4-968e-58930b2a59b2","resolution":{"observed_at":"2026-08-16T06:07:20.407725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.10628","last_updated":"2018-05-20T14:51:43Z","snapshot_observed_at":"2026-08-14T20:19:14.327014Z","submitted_at":"2017-10-29T15:30:58Z","title":"Variational Continual Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.10628","snapshot_observed_at":"2026-08-16T06:07:19.635795Z","title":"V., Li, Y., Bui, T","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.635795Z"},"links":{"cited_paper":"/paper/1710.10628","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:79df44c357f3e63f28e789de4acc15074d49d4384ad8085849261d53264c9f1c","observation_id":"3b839439-50fd-4352-86f7-964aca3c4c97","resolution":{"observed_at":"2026-08-16T06:07:19.635795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.394316Z","title":"(more) efficient reinforcement learning via posterior sampling","venue":null,"work_id":"a7bcc979-f06e-48d7-922e-81e109183cbb","year":2013},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.639417Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:b97330f28856cc27a31ab63947f7f24e3173e86c65f5ac64367a116f790c8be1","observation_id":"551dc370-d83b-4015-ae6d-200c68d636d4","resolution":{"observed_at":"2026-08-16T06:07:20.397796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.642846Z","title":"Risk averse robust adversarial reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.642846Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:6abbb9c8f9e5cc7ac3aa7dfcbc43764537a467ce0b25985f6a306409f016daef","observation_id":"bc30fc04-e964-43ee-b0dd-38a1710cb077","resolution":{"observed_at":"2026-08-16T06:07:19.642846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.646330Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.646330Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:499ce43ecf4e2b925b7d397bf26332c810d13f66b1bdd258942560da1f4b77a0","observation_id":"81ba255b-0a9b-4753-b37e-5efd2a4783a0","resolution":{"observed_at":"2026-08-16T06:07:19.646330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.649421Z","title":"Meta-learning with neural bandit scheduler","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.649421Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:fc3ff4345638703bd8e14ba90c7c19f1704d8370c67208ed9f7fc2ea254077aa","observation_id":"c2de9c67-7809-45f9-b0d2-514e663ce01c","resolution":{"observed_at":"2026-08-16T06:07:19.649421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.364744Z","title":"Hokoff: Real game dataset from honor of kings and its offline reinforcement learning benchmarks","venue":null,"work_id":"ad78d692-41d5-4d42-863e-d6c3da4f39b8","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.652730Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:ea0eb234d6c468915ee216c82f11fc7c7b7b2fbc3a0bf522f3c946b321a81af2","observation_id":"d5bd3537-2d1a-44f4-92cd-f9bb40e89e8f","resolution":{"observed_at":"2026-08-16T06:07:20.368888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02511","last_updated":"2026-05-30T09:14:19Z","snapshot_observed_at":"2026-08-18T08:49:10.874796Z","submitted_at":"2024-10-03T14:21:23Z","title":"Stop Wandering, Find the Keys: LLMs Discriminate Key States for Efficient Multi-Agent Exploration","version":2},"cited_work":{"arxiv_id":"2410.02511","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.02511","snapshot_observed_at":"2026-08-16T06:07:19.936728Z","title":"Stop Wandering, Find the Keys: LLMs Discriminate Key States for Efficient Multi-Agent Exploration","venue":"cs.AI","work_id":"e17efc75-08f6-495c-b375-64729718a838","year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.656167Z"},"links":{"cited_paper":"/paper/2410.02511","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:affefe4e036b381812e82b01c82a91cb74354bb8a042e98d7e2040ada98bb610","observation_id":"c99a8ad3-082b-4c41-9227-809318140e1d","resolution":{"observed_at":"2026-08-16T06:07:19.942774Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.354333Z","title":"Latent reward: Llm-empowered credit assignment in episodic reinforcement learning","venue":null,"work_id":"bd3842da-a856-4b0d-8fec-60a61f2766cf","year":2025},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.659467Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:bdb4f26fdda51789ff0ac6b34e89b5e9bd7418a9f5b6e3d0315c21faf853d076","observation_id":"b25e7614-0244-45db-86b5-a40bb327682d","resolution":{"observed_at":"2026-08-16T06:07:20.357963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.662642Z","title":"M., and Levine, S","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.662642Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:7b8d007fb40cda35d8003ca39e7c02597ba00ab475e4c6fd0087d92524c77a7c","observation_id":"3d905242-76d5-4c81-ac73-0180c35e1eb2","resolution":{"observed_at":"2026-08-16T06:07:19.662642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.665736Z","title":"Efficient off-policy meta-reinforcement learning via probabilistic context variables","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.665736Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:fb1d59d9307a8d481e5b942bbe74138ebdf1931374d3714d90d9fa0bc04d293a","observation_id":"60d5ae6c-a7a6-4dca-beee-76d1eccebf43","resolution":{"observed_at":"2026-08-16T06:07:19.665736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.332422Z","title":"J., Fidler, S., and Litany, O","venue":null,"work_id":"ad693f6b-386a-4bca-a549-ce95127a5849","year":2022},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.669179Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:52f143f46daa78abbce725d6a9aae6ed4e1249c5facea460b57ded380ef707fa","observation_id":"87b89c97-cf3f-487a-994d-a873bf6c236a","resolution":{"observed_at":"2026-08-16T06:07:20.335668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.672267Z","title":"B., Chen, X., and Wang, X","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.672267Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:e8b3fe612bd101535eb432102c78e495347a81619109b0642bdb5c60c4fa9e1c","observation_id":"3b880b53-a8d7-4ca5-a884-3b728f473cec","resolution":{"observed_at":"2026-08-16T06:07:19.672267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.315569Z","title":"Risk-averse bayes-adaptive reinforcement learning","venue":null,"work_id":"125a9a3e-9418-49bc-9e67-b225bc28efc6","year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.675393Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:ce2927364db645eb31fddeaf18ef5eba2eb9e4979b705b756dd6fb25484d4290","observation_id":"f7823eb2-0ff8-439a-aa19-6b91830928f8","resolution":{"observed_at":"2026-08-16T06:07:20.319048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.305226Z","title":"Been there, done that: Meta-learning with episodic recall","venue":null,"work_id":"d4b6534c-e154-4023-961c-ed4adb68320f","year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.678600Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:108cd97fca60ee8bafff28413368126c74b6985be7d9ac842bbeaf3ca2e1594b","observation_id":"5543703a-f2c1-4506-8bbd-850b2cf96ee3","resolution":{"observed_at":"2026-08-16T06:07:20.308943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.681694Z","title":"T., Uryasev, S., et al","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.681694Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:da53699ec4652b1d142abf1557b33b996f128b8113c4ab67e332c01cb0fd1aee","observation_id":"1eb0376d-39d5-47a8-b7d3-e9702776e451","resolution":{"observed_at":"2026-08-16T06:07:19.681694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.684809Z","title":"and Van Roy, B","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.684809Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:13e3a5ee5b5695b3fdd9224efcd91561bef78549c1cdb8969ef70d9211e0b8e6","observation_id":"92992d40-807e-4363-8f8d-82445fdaa4f8","resolution":{"observed_at":"2026-08-16T06:07:19.684809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.688100Z","title":"W., Hashimoto, T","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.688100Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:54467c680102f5ee21c96d12a6f61b126bdc73b364c8990a0b1b114b9ca4ce47","observation_id":"9ab5554e-712c-4b3a-917b-27ab353a1863","resolution":{"observed_at":"2026-08-16T06:07:19.688100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-16T06:07:19.691253Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.691253Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:4bb0637e85b3b9b65e0ec0a6e9d5fc99e802f544f23834534d483d40bc8a9ff7","observation_id":"c24aa8df-f8a0-4d30-83b2-fe21871d7f89","resolution":{"observed_at":"2026-08-16T06:07:19.691253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.276254Z","title":"Prompting is a double-edged sword: Improving worst-group robustness of foundation models","venue":null,"work_id":"87fd949b-8e3e-4e4b-9454-a1c5f0891e1c","year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.694623Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:7d2083ab08450cd1ad6d4360ea1a5187c6240c77572ab27d0ce78918f3e1c9e5","observation_id":"b0e4148b-a0f4-43d9-9e54-251830dc707e","resolution":{"observed_at":"2026-08-16T06:07:20.280010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.265544Z","title":"Counterfactual conservative q learning for offline multi-agent reinforcement learning","venue":null,"work_id":"2801395f-7dd8-4a88-9f95-4a726dd7bcff","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.697683Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:b6806bd6642184ab73993770ba10fc770f2bbb1d78970962b1148b688493b5c8","observation_id":"c1138d65-1084-4484-8d0d-3887b3c25aed","resolution":{"observed_at":"2026-08-16T06:07:20.269237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.254725Z","title":"Complementary attention for multi-agent reinforcement learning","venue":null,"work_id":"226df3f0-f9e8-4782-b869-0a3aebda66ef","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.700660Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:09472950d6d640a11b9e2c6901c4dc62bc6cee9e0b3c63ad9e930959b134488d","observation_id":"dca42403-e6b6-408d-9b0f-51f93d2c270a","resolution":{"observed_at":"2026-08-16T06:07:20.258683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.703760Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.703760Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:8aae6357a1c6fcbb6091efda28ba71993bf71bb79b252d28b553ef61385cc7bf","observation_id":"454e847c-0d68-4e41-8062-4a923f958261","resolution":{"observed_at":"2026-08-16T06:07:19.703760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.238447Z","title":"Policy gradient for coherent risk measures","venue":null,"work_id":"d820938b-8ed8-4850-95c6-ab0c6cb54f78","year":2015},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.706802Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:aa94e89a881adada412a2b0ec8f374efa92dae5e2ac39f5f32905ab5af09b853","observation_id":"e135e20a-24fe-43e4-ad74-5fe1fe8e0566","resolution":{"observed_at":"2026-08-16T06:07:20.241938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00425","last_updated":"2025-05-30T05:49:14Z","snapshot_observed_at":"2026-08-16T13:13:51.765058Z","submitted_at":"2024-10-01T06:10:39Z","title":"ManiSkill3: GPU Parallelized Robotics Simulation and Rendering for Generalizable Embodied AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00425","snapshot_observed_at":"2026-08-16T06:07:19.710213Z","title":"Maniskill3: Gpu parallelized robotics simulation and rendering for generalizable embodied ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.710213Z"},"links":{"cited_paper":"/paper/2410.00425","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:72fa89f8e4ab13dd531a0b0473d114670ddfd0ef0082e0d29e75a03dd306e4c2","observation_id":"f346bfa0-9a39-4f98-b3e4-e66d4a83688d","resolution":{"observed_at":"2026-08-16T06:07:19.710213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.713847Z","title":null,"venue":null,"work_id":null,"year":1933},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.713847Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:5096991f51f6127dde9a3941c972bf9e340541c3abc41796448f34938a573241","observation_id":"7c8b863b-f3d3-47f5-97ba-99f315cfc6cf","resolution":{"observed_at":"2026-08-16T06:07:19.713847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01885","last_updated":"2024-03-26T12:59:44Z","snapshot_observed_at":"2026-08-18T08:49:04.502967Z","submitted_at":"2023-11-03T12:54:05Z","title":"Domain Randomization via Entropy Maximization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01885","snapshot_observed_at":"2026-08-16T06:07:19.717212Z","title":"Domain randomization via entropy maximization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.717212Z"},"links":{"cited_paper":"/paper/2311.01885","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:b000306479beabd5d620b477e031c4edb08ef3eb8134f5771b694e17cb1658a7","observation_id":"9b8e0d7a-63b7-4354-a78a-379b9e52ae3e","resolution":{"observed_at":"2026-08-16T06:07:19.717212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.720919Z","title":"Domain randomization for transferring deep neural networks from simulation to the real world","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.720919Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:705b0f43253b112381df6621bda33bf503967e232e84ec9c30d8911d239706ad","observation_id":"f05afa65-1ef3-4159-9de9-1b58e8cd730c","resolution":{"observed_at":"2026-08-16T06:07:19.720919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.724132Z","title":"Mujoco: A physics engine for model-based control","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.724132Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:882bf2ff7811be403f07c1856b86a9237d104261b456ef308f63d9cc49904df4","observation_id":"911e0356-f945-4776-a7d5-931688ce6c72","resolution":{"observed_at":"2026-08-16T06:07:19.724132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.727152Z","title":"N., Vapnik, V., et al","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.727152Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:d0b45e9dc616c31fea189793887ff1d616aeed7cfdc0f29c3f8669c5e657d211","observation_id":"4bbdb804-6c21-48aa-a9ab-60fa43844b8a","resolution":{"observed_at":"2026-08-16T06:07:19.727152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13237","last_updated":"2024-07-18T07:47:51Z","snapshot_observed_at":"2026-08-18T08:49:09.270813Z","submitted_at":"2024-07-18T07:47:51Z","title":"LLM-Empowered State Representation for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13237","snapshot_observed_at":"2026-08-16T06:07:19.730282Z","title":"Llm-empowered state representation for reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.730282Z"},"links":{"cited_paper":"/paper/2407.13237","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:503ba225617e77da879e0a89227553dae82541c441372f386ec61e2381c90201","observation_id":"450bf3bf-cd93-4342-baff-0af5473f97e5","resolution":{"observed_at":"2026-08-16T06:07:19.730282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19523","last_updated":"2025-01-06T14:02:17Z","snapshot_observed_at":"2026-08-18T08:49:10.302009Z","submitted_at":"2024-07-28T16:23:55Z","title":"Robust Fast Adaptation from Adversarially Explicit Task Distribution Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19523","snapshot_observed_at":"2026-08-16T06:07:19.733479Z","title":"Robust fast adaptation from adversarially explicit task distribution generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.733479Z"},"links":{"cited_paper":"/paper/2407.19523","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:5b698829779ef832b692574748a1577c5dc7e625c003d7631f270b320481045e","observation_id":"932eb590-c4d9-47e8-a013-3a3f5c2caed3","resolution":{"observed_at":"2026-08-16T06:07:19.733479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.203587Z","title":"and Van Hoof, H","venue":null,"work_id":"97d2c374-5930-401d-a000-1a16c85a33fa","year":2020},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.736690Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:669478c8265b79763276787f209ce81a692cd5c1b0ef779f15d8ebb2fb20232d","observation_id":"de78651d-fc48-4d6f-a572-d227deb1ec3c","resolution":{"observed_at":"2026-08-16T06:07:20.207349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.193171Z","title":"and Van Hoof, H","venue":null,"work_id":"6e63383a-01e3-474d-8aea-5815a7f474d9","year":2022},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.739818Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:b20aabbf0a4295b9ddafea5f463e92aa0bc33ecbdce2e257cba65edf81ee5f32","observation_id":"332c131a-42bd-4c21-800c-77e06e2532a3","resolution":{"observed_at":"2026-08-16T06:07:20.196751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.182884Z","title":"and Van Hoof, H","venue":null,"work_id":"94d807a8-2fc2-482a-bb29-f332a4dd45bd","year":2022},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.742889Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:5b87be1cb4003e39ec33faa9934af0c1ad9fec499ca515f4e1760acf68cdc92f","observation_id":"e5755f72-9968-40e7-8150-c53782f0a346","resolution":{"observed_at":"2026-08-16T06:07:20.186407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.171000Z","title":"Bridge the inference gaps of neural processes via expectation maximization","venue":null,"work_id":"a2768ee2-ec47-46b0-a6a2-cc4b4b3e1b1a","year":2022},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.746258Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:e06dc3111b19069c4f2be503d746c07720c0a04dccf4c7147bd1e71a8959947d","observation_id":"3e54db66-d416-48ce-b0a7-f000105f813a","resolution":{"observed_at":"2026-08-16T06:07:20.175111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.160139Z","title":"Bridge the inference gaps of neural processes via expectation maximization","venue":null,"work_id":"124068a9-cd1b-419f-b51d-6c3a335342e7","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.749224Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:736517c5181c3084a1c28ad934207c39323bae47845f066366667b93f0acdbfa","observation_id":"1819eff5-2710-4920-8ae0-32c5a4631aa6","resolution":{"observed_at":"2026-08-16T06:07:20.163804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.149317Z","title":"A simple yet effective strategy to robustify the meta learning paradigm","venue":null,"work_id":"d1cdc3de-c314-4d93-b27b-e771462c2e0b","year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.752321Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:e9b874cf823b14db3431c73909b59a3e3e898ee85f6541cf2f3a55ffa1d033fe","observation_id":"785659ff-e84c-45ef-a2a6-f488a576919b","resolution":{"observed_at":"2026-08-16T06:07:20.153016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.758674Z","title":"C., Xiao, Z., Mao, Y., Qu, Y., Shen, J., Lv, Y., and Ji, X","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.758674Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:033f2baca27e733060ffe52821096a81e5a0bd22fcbeae816e6c17545dfc29ee","observation_id":"b922284c-bd28-4f68-84e1-7b097446435b","resolution":{"observed_at":"2026-08-16T06:07:19.758674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.139189Z","title":"Max-min diversification with fairness constraints: Exact and approximation algorithms","venue":null,"work_id":"f8d4a950-0990-42f7-a82d-b33ebc4be086","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.762013Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:99738630333e63a23bc41f088976d38d45e02c89eea7e43fdaf1cf9d13c32a6c","observation_id":"9e805beb-f4c3-45a6-b04f-0c97540e7fb1","resolution":{"observed_at":"2026-08-16T06:07:20.142842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.128554Z","title":"Entropy-based active learning for object detection with progressive diversity constraint","venue":null,"work_id":"d23c7fbf-f89f-4f1f-ae68-b14a911c6078","year":2022},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.765397Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:e6c5a8e7e72c28587bec4b55de7673f66c075ac4f9233119db173afdf9a21471","observation_id":"50d7c5f2-06e2-4879-ba82-e4f9643a5733","resolution":{"observed_at":"2026-08-16T06:07:20.132062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.118291Z","title":"Enhancing context-based meta-reinforcement learning algorithms via an efficient task encoder (student abstract)","venue":null,"work_id":"77f866c3-5363-4826-bddb-90f24e036790","year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.768519Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:3dbbff6996a6c2e4bb637f5067b8a8e69055fb87ad118f17e34b5b4b58ba0426","observation_id":"173e4ce0-585b-4a84-ac1c-48d876fc04cd","resolution":{"observed_at":"2026-08-16T06:07:20.121864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.772193Z","title":"Bayesian model-agnostic meta-learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.772193Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:0740194a74009b21971af0175671948fd52372552c2d06e795995f360ba0f84e","observation_id":"5ade9aee-9d27-4eb9-abbb-5de699f1a2ad","resolution":{"observed_at":"2026-08-16T06:07:19.772193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.101532Z","title":"In-sample actor critic for offline reinforcement learning","venue":null,"work_id":"e2c3623f-839e-4140-8200-c257c5591ec7","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.775352Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:abb47db8146c7618e370a01d914edeef8c21fe2aa555804ee0743987c6e2f9ad","observation_id":"c8f669a2-91a3-409f-93e8-6bcc611ac78f","resolution":{"observed_at":"2026-08-16T06:07:20.105029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.091263Z","title":"Combining active learning and semi-supervised learning using gaussian fields and harmonic functions","venue":null,"work_id":"71f93e95-24df-44d5-9101-a375ebb9a73c","year":2003},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.778563Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:391597660539141b55344c016f28db0c1adf793f947932598bfe66350e34a15d","observation_id":"79df17aa-53a6-4126-bccd-7de4dd4c6752","resolution":{"observed_at":"2026-08-16T06:07:20.094970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.08348","last_updated":"2020-02-27T19:40:21Z","snapshot_observed_at":"2026-08-18T08:49:08.724754Z","submitted_at":"2019-10-18T11:44:59Z","title":"VariBAD: A Very Good Method for Bayes-Adaptive Deep RL via Meta-Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.08348","snapshot_observed_at":"2026-08-16T06:07:19.781695Z","title":"Varibad: A very good method for bayes-adaptive deep rl via meta-learning","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.781695Z"},"links":{"cited_paper":"/paper/1910.08348","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:e1a70de4fdfeb5b983874296cb97c1b16788a998b4654de5142a0550fce875ef","observation_id":"0a639983-ad2c-4d88-b0bd-d292922863b0","resolution":{"observed_at":"2026-08-16T06:07:19.781695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.785138Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.785138Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:9e6f2a44be9f1939074728e6f06410840bfced34345c63dafa8eed989e8b85bb","observation_id":"d7272cf5-1381-4047-a0c9-7ee5a53ea186","resolution":{"observed_at":"2026-08-16T06:07:19.785138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T08:47:04.081950Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":64,"verified_exact":2,"verified_fuzzy":34},"total_outbound_references":100},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 100 of 100 outbound references and 0 inbound Pith citation observations for arXiv:2504.19139."}