{"as_of":"2026-08-09T15:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4003611cbfd1906557be7c47d0cc2de74a70c12e4c3f0fe1e978af82b7552965","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T10:08:35.693456Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2510.12152/citation-record","integrity":"/paper/2510.12152/integrity","json":"/paper/2510.12152/citation-record.json","paper":"/paper/2510.12152"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.583366Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.583366Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:6d6b03050c61ebb3fd2fecbfa839aaf0f73f4acb81448d578729fad74862cf90","observation_id":"8b2e1561-a487-42fe-8183-20b87ccfeffe","resolution":{"observed_at":"2026-08-04T10:08:31.583366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.637586Z","title":"Fighting bandits with a new kind of smoothness","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.637586Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:90c058678845cea9e4798f3152386dc8e57f576f5633288e1d20750f78a8f5ce","observation_id":"e541812b-f769-46d6-a82b-6567182fc513","resolution":{"observed_at":"2026-08-04T10:08:31.637586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.699787Z","title":"The nonstochastic multiarmed bandit problem","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.699787Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:ae4c30b8379c89b6efd6f27b7692ad3c1643244db25a050a3e16dfeb92a0ed37","observation_id":"2bbb536a-e2d6-465c-9cd5-b138d073dab4","resolution":{"observed_at":"2026-08-04T10:08:31.699787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.743170Z","title":"Decoupling exploration and exploitation in multi-armed bandits","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.743170Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:96dfee673e04bf96210eaed57d430774bbe3145f408458478e5f6e37d6c9d54a","observation_id":"282e5612-477d-4c2c-becd-fe889bd7bdcc","resolution":{"observed_at":"2026-08-04T10:08:31.743170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.795159Z","title":"Bandit algorithms for e-commerce recommender systems","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.795159Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:aedb3a07593b1afa71922604e0edfb4224164febc3ab9cb07a675bb8310c5134","observation_id":"0a1c484e-1ea1-4d6a-8c8b-3ccff044cfa8","resolution":{"observed_at":"2026-08-04T10:08:31.795159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.849827Z","title":"Five miracles of mirror descent, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.849827Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:9afcf73b5df7e94cf64a893d7ac033253c467139de52c501ead35f6af03afcc3","observation_id":"3e0a3ebc-41ab-41c3-80fd-281afc2f3ee6","resolution":{"observed_at":"2026-08-04T10:08:31.849827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.905844Z","title":"Regret analysis of stochastic and nonstochastic multi-armed bandit problems","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.905844Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:e6dccc3022eda7e2be0c158e0f5aa9240ad67a540283bb4fa82822df8f016cb5","observation_id":"4fdd0aa5-dc12-4b4f-ae22-9dcab4e02cb8","resolution":{"observed_at":"2026-08-04T10:08:31.905844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:31.963263Z","title":"The best of both worlds: Stochastic and adversarial bandits","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:31.963263Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:aa28d1c8b91ce2d6daf5d07a1ccdb882f46958f7177d676f3885795ce909fd0d","observation_id":"81d367f8-68fd-4099-9e69-9abc30cd7ac7","resolution":{"observed_at":"2026-08-04T10:08:31.963263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.00757","last_updated":"2015-11-03T18:37:43Z","snapshot_observed_at":"2026-08-03T21:30:46.125285Z","submitted_at":"2015-10-02T23:28:11Z","title":"A Survey of Online Experiment Design with the Stochastic Multi-Armed Bandit","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.00757","snapshot_observed_at":"2026-08-04T10:08:32.022880Z","title":"A survey of online experiment design with the stochastic multi-armed bandit","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:32.022880Z"},"links":{"cited_paper":"/paper/1510.00757","citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:bdc82ade110c98059fa7ef6f1f17e5d795d50a5cad4800c198abd512a5762326","observation_id":"5ae193ea-4ef8-4932-b117-789e3bbff22f","resolution":{"observed_at":"2026-08-04T10:08:32.022880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03324","last_updated":"2025-06-03T19:14:53Z","snapshot_observed_at":"2026-08-08T21:07:44.959116Z","submitted_at":"2025-06-03T19:14:53Z","title":"Optimization of Epsilon-Greedy Exploration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03324","snapshot_observed_at":"2026-08-04T10:08:32.141050Z","title":"Optimization of epsilon-greedy exploration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:32.141050Z"},"links":{"cited_paper":"/paper/2506.03324","citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:3ca3869a8a8d187c50ef838cce4dd327190347ee9e450564852f7119493e5da9","observation_id":"1e14f41d-a43b-4a9e-b494-370aea945480","resolution":{"observed_at":"2026-08-04T10:08:32.141050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:32.306226Z","title":"Geometric resampling in nearly linear time for Follow-the-Perturbed-Leader with Best-of-Both-Worlds guarantee in bandit problems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:32.306226Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:c34cc74b0479d1c6b7c90376e970e4d75723cc32be0bd8f068a81570397978c9","observation_id":"7c56f155-a18f-4415-8e7c-30976d4ad614","resolution":{"observed_at":"2026-08-04T10:08:32.306226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:32.492703Z","title":"Action elimination and stopping conditions for the multi-armed bandit and reinforcement learning problems","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:32.492703Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:91b90b2d4b1a9336aa4f263b666ff18fc6b84b615cc39cb9f6ddafc6e7599f62","observation_id":"4070d39e-dd31-4c0b-98d3-91e5ac927278","resolution":{"observed_at":"2026-08-04T10:08:32.492703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:32.653283Z","title":"On explore-then-commit strategies","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:32.653283Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:461dca92306fb194127c5f4a031036b7a61c1c77c68e767c97357331edb4a166","observation_id":"af83966e-fafb-4790-9e95-e9f2e46b9546","resolution":{"observed_at":"2026-08-04T10:08:32.653283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:32.739844Z","title":"Follow-the-Perturbed-Leader achieves Best-of-Both-Worlds for bandit problems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:32.739844Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:0a349e43adbe7cad53ca91441026f777e58a3995ea4e70d4611e64975ab2a0a9","observation_id":"85ee46ac-06be-48dc-bd0d-43cc2ac8459f","resolution":{"observed_at":"2026-08-04T10:08:32.739844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:32.908261Z","title":"Adaptive learning rate for Follow-the-Regularized-Leader : Competitive analysis and Best-of-Both-Worlds","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:32.908261Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:922519ac0e417a7492a6733c55d4fe53de94eed6df6663257bfdbe4210a76e29","observation_id":"fd173f7b-364c-4ac8-a834-fd5652efcdc7","resolution":{"observed_at":"2026-08-04T10:08:32.908261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:33.089293Z","title":"Improved Best-of-Both-Worlds guarantees for multi-armed bandits: FTRL with general regularizers and multiple optimal arms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:33.089293Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:448a5ba9ee1566f547d1ab7afe6460d37a9144e9560aa3c820ddb5b2ce026fb8","observation_id":"7aba412f-9013-4fcb-a435-a88ec9fa3015","resolution":{"observed_at":"2026-08-04T10:08:33.089293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:33.227646Z","title":"An -best-arm identification algorithm for fixed-confidence and beyond","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:33.227646Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:2c6708705c7bcdc449c4b69ec17c5503228be091eadaa3db9c9b653fabe3fea4","observation_id":"f5e91056-a704-4e3a-9107-d03a4d61c295","resolution":{"observed_at":"2026-08-04T10:08:33.227646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:33.406411Z","title":"On the optimality of perturbations in stochastic and adversarial multi-armed bandit problems","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:33.406411Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:aa3a3eca4a39eb620a2c2237f3d40d985ada78600d4c1c58c02658043ca5302a","observation_id":"8105a29d-78af-4284-82c0-304c68afeef9","resolution":{"observed_at":"2026-08-04T10:08:33.406411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:33.598175Z","title":"Follow-the-Perturbed-Leader with F r\\'echet-type tail distributions: Optimality in adversarial bandits and best-of-both-worlds","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:33.598175Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:dec11ec91c602592f5e409eae5293215ad7e7bc8134a5c634253445ab4900676","observation_id":"593e55c9-e3be-4e5e-b0f2-b73fa619449a","resolution":{"observed_at":"2026-08-04T10:08:33.598175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:33.738612Z","title":"Revisiting Follow-the-Perturbed-Leader with unbounded perturbations in bandit problems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:33.738612Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:031e5ee1e2367b617ca474c8ace42e18a709f589ebc121225a8ba1f367b62e3d","observation_id":"6d8b16d7-d1ef-4672-800b-4784a17020b0","resolution":{"observed_at":"2026-08-04T10:08:33.738612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:33.844790Z","title":"Schwartz, and Jacob Abernethy","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:33.844790Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:832e46f279d035cc6a8729fcb045f8e47b1acecc7afbf58cbc51996f5ff2533b","observation_id":"cb2659cc-c4ab-433f-83b5-93d7c7cc5b92","resolution":{"observed_at":"2026-08-04T10:08:33.844790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:33.987126Z","title":"Low-rank bandit methods for high-dimensional dynamic pricing","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:33.987126Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:9430623a7279c119ed3160db58db2858da78adb01114fef334d73cdd268f4134","observation_id":"7f873626-0803-4699-85e1-e466c3959a7b","resolution":{"observed_at":"2026-08-04T10:08:33.987126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.050481Z","title":"Importance weighting without importance weights: An efficient algorithm for combinatorial semi-bandits","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.050481Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:20c3d48abe24e450600f0b322eb218b18d6f94490cf8386dfd8d603ed80171d7","observation_id":"e94a06b5-e559-4839-8d97-622e132d28c7","resolution":{"observed_at":"2026-08-04T10:08:34.050481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.109425Z","title":"Conic optimization via operator splitting and homogeneous self-dual embedding","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.109425Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:fc47d82e9e46302c6ae66df707d524a8ee97d98bf7633f7e4e9ded97bd3f3505","observation_id":"d1f195b8-ab4e-4d32-9f27-6f3251520ba6","resolution":{"observed_at":"2026-08-04T10:08:34.109425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.171912Z","title":"NIST handbook of mathematical functions hardback and CD-ROM","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.171912Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:a1d8e7b161bd1830a85caba54d554ddc3c5a4b2b33724cc2515cd01d46941ada","observation_id":"0a40b282-1cff-46b3-916c-130cee3ceb22","resolution":{"observed_at":"2026-08-04T10:08:34.171912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.262254Z","title":"Tsallis-inf for decoupled exploration and exploitation in multi-armed bandits","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.262254Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:b533ccb0fe1eb7a156c22e2bf17853cccaeab94dfddae294dc02c23b91cd55b0","observation_id":"0a5b5b7f-19be-438d-bb23-1fbbea30172c","resolution":{"observed_at":"2026-08-04T10:08:34.262254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.399273Z","title":"Follow the perturbed leader: Optimism and fast parallel algorithms for smooth minimax games","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.399273Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:d023de039cc0a48d86126a2f475fafbd7be1863cce5dd261648243a22a4a8d0e","observation_id":"48528644-b780-412c-b2c6-e81a547e0dfc","resolution":{"observed_at":"2026-08-04T10:08:34.399273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.538073Z","title":"Stability-penalty-adaptive follow-the-regularized-leader: Sparsity, game-dependency, and best-of-both-worlds","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.538073Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:22adbd6a8f1c7ef4edd4db09a621826facc639633c906cf88be81ac6866344ae","observation_id":"e7a8c603-6efc-40d6-b8a7-ead6231ae691","resolution":{"observed_at":"2026-08-04T10:08:34.538073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.674566Z","title":"More adaptive algorithms for adversarial bandits","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.674566Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:41fdb0b4c8cf12b9424c319a738ffc1fbad415a435ac0e4b4dad9c34e68fb298","observation_id":"5ae7962a-492c-490c-937d-5eaa3135ef06","resolution":{"observed_at":"2026-08-04T10:08:34.674566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07307","last_updated":"2025-07-07T14:25:36Z","snapshot_observed_at":"2026-08-07T16:07:02.808962Z","submitted_at":"2025-04-09T22:07:01Z","title":"Follow-the-Perturbed-Leader Approaches Best-of-Both-Worlds for the m-Set Semi-Bandit Problems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07307","snapshot_observed_at":"2026-08-04T10:08:34.818772Z","title":"Follow-the-perturbed-leader approaches best-of-both-worlds for the m-set semi-bandit problems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.818772Z"},"links":{"cited_paper":"/paper/2504.07307","citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:0f443c4ec712b983c95b8f0e05dabbc57e9d2cb3e11d855d8ff6f9f7a73452f1","observation_id":"cfc70a12-31a9-4877-8d0f-23c7a67d0df1","resolution":{"observed_at":"2026-08-04T10:08:34.818772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:34.942014Z","title":"Sim-to-real transfer in deep reinforcement learning for robotics: a survey","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:34.942014Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:94110b0ecc0224fe2bb41a97448578e134d1114c0643feb7f17b1b2b354823fe","observation_id":"50616895-bab8-4fd3-b83a-27cab1436c84","resolution":{"observed_at":"2026-08-04T10:08:34.942014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:35.054270Z","title":"Large-scale bandit approaches for recommender systems","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:35.054270Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:1cbb43df62fc9147f817ac92ff5a3162f93d6302c462f05af60fb5e7a3fdf343","observation_id":"e8105c46-a957-420f-97b5-dd5e03d762e6","resolution":{"observed_at":"2026-08-04T10:08:35.054270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:35.171506Z","title":"Tsallis- INF : A n optimal algorithm for stochastic and adversarial bandits","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:35.171506Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:efecf26589887337bc3f26fe1cc9a751c962d9527efc100b822a1af05689a75e","observation_id":"81832b05-4320-4fe2-b84c-5163929192d9","resolution":{"observed_at":"2026-08-04T10:08:35.171506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:35.373349Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:35.373349Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:a7bb4940e2393600ca217dc365d7dfcafbd17e8fd77865a1669c917865311fb6","observation_id":"e3ed60d5-f6f9-42a4-9ce7-df3f400b1b0a","resolution":{"observed_at":"2026-08-04T10:08:35.373349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:08:35.560570Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:35.560570Z"},"links":{"citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:7e5c0a47972f76378fdc8316cc38019c2e6d7ef17c2f59a650981262ee9769c2","observation_id":"eb280f17-edba-4edc-b93a-1f3917e301bb","resolution":{"observed_at":"2026-08-04T10:08:35.560570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20028","last_updated":"2025-02-16T19:26:49Z","snapshot_observed_at":"2026-07-06T18:22:40.048076Z","submitted_at":"2024-05-30T13:13:12Z","title":"A Simple and Adaptive Learning Rate for FTRL in Online Learning with Minimax Regret of $\\Theta(T^{2/3})$ and its Application to Best-of-Both-Worlds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20028","snapshot_observed_at":"2026-08-04T10:08:35.693456Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T10:08:35.693456Z"},"links":{"cited_paper":"/paper/2405.20028","citing_paper":"/paper/2510.12152"},"observation_digest":"sha256:110504d088e10accd713a436b2820534289ed94633a90c5272d457e1427aee9d","observation_id":"af35d759-7b1c-4c33-a4f4-7434c274fe1c","resolution":{"observed_at":"2026-08-04T10:08:35.693456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.12152","last_updated":"2026-05-28T06:33:59Z","latest_version":2,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-08T21:08:00.200960Z","submitted_at":"2025-10-14T05:14:54Z","title":"Follow-the-Perturbed-Leader for Decoupled Bandits: Best-of-Both-Worlds and Practicality"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2510.12152."}