{"as_of":"2026-08-18T11:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:92d7e1f22bbb413d1293a5b65c005479b2c1e2b7b767a1105ba0f28058ee7033","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T12:06:20.486932Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.02486/citation-record","integrity":"/paper/2502.02486/integrity","json":"/paper/2502.02486/citation-record.json","paper":"/paper/2502.02486"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1406.6812","last_updated":"2014-06-26T08:57:05Z","snapshot_observed_at":"2026-08-14T23:29:00.397235Z","submitted_at":"2014-06-26T08:57:05Z","title":"Online learning in MDPs with side information","version":1},"cited_work":{"arxiv_id":"1406.6812","doi":null,"metadata_source":"pith","pith_arxiv_id":"1406.6812","snapshot_observed_at":"2026-08-09T12:06:20.849547Z","title":"Online learning in MDPs with side information","venue":"cs.LG","work_id":"8d7ac29b-2391-4b30-90de-e2ee602e2390","year":2014},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.283510Z"},"links":{"cited_paper":"/paper/1406.6812","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:b8285fc8fac010ebd313c8c53d04a250a66f51a0b8a1f797621d4d41433b96ea","observation_id":"b1d9a221-a4bf-4f1e-af70-8fade455437a","resolution":{"observed_at":"2026-08-09T12:06:20.854120Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.288875Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.288875Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:17ec6f10b99ef6355dcfcc713980946252e325250ca9c7f96f641a519b88de55","observation_id":"b2f45b8d-0ec5-4963-a315-3b175a669495","resolution":{"observed_at":"2026-08-09T12:06:20.288875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.230262Z","title":null,"venue":null,"work_id":"f77a6128-d1f2-418c-8c96-fc7f9bef1157","year":2023},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.293092Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:0ec214d8735d3210378441c6a54db150f20d40bf8cd77882b6bcdee31a61095b","observation_id":"b57e6b4e-a661-4393-b26b-c9cc6c01c750","resolution":{"observed_at":"2026-08-09T12:06:21.234114Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.218786Z","title":"and Catoni, O","venue":null,"work_id":"d47c1286-10b0-46dd-b0bb-7740ac9f4cf9","year":2011},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.297750Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:5b6d78492e1705f1ff6cef619f57ce0348885d4ac7567ef294d445e66156f391","observation_id":"6de77f9f-85a0-46e6-b97c-fc32cb7a5c2b","resolution":{"observed_at":"2026-08-09T12:06:21.222744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.206822Z","title":null,"venue":null,"work_id":"f1d44292-584a-4e63-b576-0911c8d8c663","year":2013},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.302131Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:ae46d32ede401b33828754d2f8fe2b28dae83d95ca8520321e2a14f2ee72821a","observation_id":"c2c1025e-23d9-483b-ac7d-0e58dda4df04","resolution":{"observed_at":"2026-08-09T12:06:21.210616Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.192629Z","title":"F., Balseiro, S","venue":null,"work_id":"4c1af141-af51-4e5b-b45d-9e397224df9b","year":2020},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.306282Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:c8558a964bbb84d4bfd39294c210431c6e31eda77cd6635fa77b07b74645f6fb","observation_id":"2c36c767-46f1-46f2-a959-d25613b4395c","resolution":{"observed_at":"2026-08-09T12:06:21.198026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.179635Z","title":null,"venue":null,"work_id":"73433fcf-1ed0-4426-973b-0efa077eabbe","year":2011},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.311181Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:bd5dd30a1206748d2667b55b585862507dfdcdffb65abab288cc5c56429d163e","observation_id":"59ee96c3-41c4-4612-a957-ac646f1834e0","resolution":{"observed_at":"2026-08-09T12:06:21.184770Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.166930Z","title":null,"venue":null,"work_id":"7c0facfb-949d-4e10-8273-fc916d4e6784","year":2001},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.315387Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:8f0be2d3d9f641be07c835a4248a7652314cef3cab8a39aea26a3eeca859b9c5","observation_id":"b0b273fe-0523-48d1-b57d-e12f843d0f23","resolution":{"observed_at":"2026-08-09T12:06:21.170750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.154903Z","title":null,"venue":null,"work_id":"d9a54724-fe54-4cab-8664-bb6d65edfb33","year":2022},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.319418Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:cf3327b11ba4b4ca63a2e9ac2b7c60006e72b8f2867fbeb9987bbc6b169f4046","observation_id":"7de8728b-8cc2-42d9-9e4f-816e59e6c902","resolution":{"observed_at":"2026-08-09T12:06:21.159206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.142124Z","title":null,"venue":null,"work_id":"4f605ead-ef96-40b6-b013-48dcb1c54683","year":2023},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.323336Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:721c0e94892ae07f8ab06540f56545e6849318b89718c136029685a9a419f1c9","observation_id":"c9bdab7f-89f0-40f7-87c9-dc7094898b17","resolution":{"observed_at":"2026-08-09T12:06:21.146250Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.128855Z","title":null,"venue":null,"work_id":"54484421-e812-47a6-bb92-055fabe3a971","year":2022},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.327768Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:e572bfad49b4afa5f32b1055a0c7b6ea90e245ae67a8980cd6f7b87e4b33f082","observation_id":"3e912f57-d7e4-4c8c-afa3-9061dd6b2f73","resolution":{"observed_at":"2026-08-09T12:06:21.133627Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.114651Z","title":null,"venue":null,"work_id":"f4439b6f-f5af-451b-b6e2-e625fe944d03","year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.332319Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:05e9f96d24054ac80b8fe9ea33be21ac6599d7e686579f5af9f0122d3590d3f8","observation_id":"d04aea70-796e-4773-9686-0efec6ee7d00","resolution":{"observed_at":"2026-08-09T12:06:21.118760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.101172Z","title":null,"venue":null,"work_id":"1cebb8bd-3c68-462b-b0b1-34f015f3bff3","year":2012},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.336068Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:377be64ea55d40050c8b27d48827fc5bb9d7f1b3246ba98733ef38b01cc151a4","observation_id":"0c535ddc-a5a4-47e7-8b2a-fcbb91936a1d","resolution":{"observed_at":"2026-08-09T12:06:21.105422Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.088671Z","title":"I., Morshed, Z., Shankar, A., Arli, D., and Pentecost, R","venue":null,"work_id":"39fb82e2-5022-41bb-a154-b23d8c0b04f9","year":2021},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.340432Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:c0c83196d8938503f182f623379b74b783da50c44d1083170f6d5a463d0e4d9f","observation_id":"9f54c63c-6aa3-4c90-868e-8e70cda9ce92","resolution":{"observed_at":"2026-08-09T12:06:21.092755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.03289","last_updated":"2023-02-04T21:49:44Z","snapshot_observed_at":"2026-08-16T17:43:50.801826Z","submitted_at":"2021-11-05T06:47:27Z","title":"Improved Regret Analysis for Variance-Adaptive Linear Bandits and Horizon-Free Linear Mixture MDPs","version":4},"cited_work":{"arxiv_id":"2111.03289","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.03289","snapshot_observed_at":"2026-08-09T12:06:20.831745Z","title":"Improved Regret Analysis for Variance-Adaptive Linear Bandits and Horizon-Free Linear Mixture MDPs","venue":"stat.ML","work_id":"18764a09-3527-4256-98c5-847c59177659","year":2021},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.344733Z"},"links":{"cited_paper":"/paper/2111.03289","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:a035faff766449b59fd81766cb09121e66e949c30b500443875864a6599f704e","observation_id":"c034341c-f12a-4871-bcc8-3e228f1de5d5","resolution":{"observed_at":"2026-08-09T12:06:20.836248Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.076244Z","title":"and Sun, Q","venue":null,"work_id":"c93bb49d-b176-4c89-aa23-d3058c9ef581","year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.358477Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:719ec9999b5793c6eb4d8ca689f718bfe4b2ea017cbeb33d48e475a4bc744723","observation_id":"c020fbf2-9808-4c56-a243-ae5296575bf2","resolution":{"observed_at":"2026-08-09T12:06:21.080495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.062002Z","title":"and Mendelson, S","venue":null,"work_id":"145ec1da-ff92-4905-af3f-25b0355a8d2d","year":2019},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.363488Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:ba9422059f4b60bd5d4d5512b562c4bd1c6532cb74d401c8fc9730e94706293d","observation_id":"341a3287-5289-4259-9d57-0e044c092e2e","resolution":{"observed_at":"2026-08-09T12:06:21.067482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.047919Z","title":null,"venue":null,"work_id":"0545a0b1-e96a-4bda-8b7c-8397b965193d","year":2016},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.367975Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:52df870e3893bcad8e6d5c3554d96c81a1efd07c8f63513d1c80ee1e5ad1206a","observation_id":"ae5bdc00-c717-46fb-bb66-76ba6602dfc3","resolution":{"observed_at":"2026-08-09T12:06:21.052190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.033941Z","title":null,"venue":null,"work_id":"d165f515-1d41-41c2-987f-8756a2dde167","year":2013},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.372233Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:3e777ed52f1f46135bc96db913baa6ad03c0a6a29c2b1e8abc557277abdf1efb","observation_id":"4fb69c8c-c38a-4f72-9401-2211f25acba7","resolution":{"observed_at":"2026-08-09T12:06:21.038877Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16197","last_updated":"2025-03-15T19:53:31Z","snapshot_observed_at":"2026-08-16T13:15:48.375642Z","submitted_at":"2024-09-24T15:42:04Z","title":"Second Order Bounds for Contextual Bandits with Function Approximation","version":3},"cited_work":{"arxiv_id":"2409.16197","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.16197","snapshot_observed_at":"2026-08-09T12:06:20.814598Z","title":"Second Order Bounds for Contextual Bandits with Function Approximation","venue":"cs.LG","work_id":"5041ffed-e727-423d-8e98-38925800ad19","year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.376466Z"},"links":{"cited_paper":"/paper/2409.16197","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:92bfbe8a01758d4ffc7bf804f740666a2d3daada3f66bb7ced1f24ae43f6f906","observation_id":"15d1be39-2c24-4da7-b2d5-cb6e89fbc349","resolution":{"observed_at":"2026-08-09T12:06:20.819090Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.019382Z","title":"and Van Roy, B","venue":null,"work_id":"52dbd665-14f2-4d38-aa47-d43131bf0d81","year":2013},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.381410Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:4bbacfc509dbe8d5234f27a8c6eb09dcfe91c6c1c7dd70da8a31f32bc7b39f51","observation_id":"54e81fdd-147c-4178-81e9-80feffdd0ef3","resolution":{"observed_at":"2026-08-09T12:06:21.023815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:21.003313Z","title":null,"venue":null,"work_id":"792ceb02-271e-4c1a-bdd7-f56263911cc6","year":2018},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.385999Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:f40d8fbfbb2d470d8c7305ebc565ae8dfbfdd74bc3b514f2b8cea10eb0ea6275","observation_id":"ec3791c4-e5df-49af-8705-eeb0f54f3f3e","resolution":{"observed_at":"2026-08-09T12:06:21.009268Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.981223Z","title":"J., Chen, Y., Simchowitz, M., Du, S., and Jamieson, K","venue":null,"work_id":"c6272161-1fa1-4f63-aaae-33e90b0ff783","year":2022},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.393218Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:12da3cefcebed0b9cd64f253b488d0e04e3ece9f3ce8c006dfe684e5384c1567","observation_id":"29a0419c-f20e-49b3-aaa1-9b1b6db156f0","resolution":{"observed_at":"2026-08-09T12:06:20.985432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.400012Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.400012Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:282055a097c62381990e063defa303ba02ab55309c5e1f6cb51bc87893415216","observation_id":"f1531abe-75f5-45d1-853c-54a06a51e006","resolution":{"observed_at":"2026-08-09T12:06:20.400012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12799","last_updated":"2025-04-04T15:09:19Z","snapshot_observed_at":"2026-08-16T13:17:09.503412Z","submitted_at":"2024-09-19T14:10:38Z","title":"The Central Role of the Loss Function in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12799","snapshot_observed_at":"2026-08-09T12:06:20.404876Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.404876Z"},"links":{"cited_paper":"/paper/2409.12799","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:14028f9ffbb9e91745774dcb68fdb3e3efd10d928bbe5e39ba2bd41c000acc97","observation_id":"b7ac19de-ab35-4128-b605-1bb08e839728","resolution":{"observed_at":"2026-08-09T12:06:20.404876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07198","last_updated":"2024-02-11T13:25:53Z","snapshot_observed_at":"2026-08-16T14:19:33.433106Z","submitted_at":"2024-02-11T13:25:53Z","title":"More Benefits of Being Distributional: Second-Order Bounds for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07198","snapshot_observed_at":"2026-08-09T12:06:20.410377Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.410377Z"},"links":{"cited_paper":"/paper/2402.07198","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:6e9bf62d8b3957154c42506052035457066f71c4727fa15e24e3c2294be4032c","observation_id":"e436da6d-d4cb-4263-92f1-287d22690f4f","resolution":{"observed_at":"2026-08-09T12:06:20.410377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08994","last_updated":"2024-10-29T08:21:36Z","snapshot_observed_at":"2026-08-18T08:36:25.725450Z","submitted_at":"2024-08-16T19:52:53Z","title":"Model-based RL as a Minimalist Approach to Horizon-Free and Second-Order Bounds","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08994","snapshot_observed_at":"2026-08-09T12:06:20.417142Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.417142Z"},"links":{"cited_paper":"/paper/2408.08994","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:c3adc64d59bb6f4de2e7e879a7d4297c528eafa50d3ff72109c76d5818969238","observation_id":"8ed37462-15c2-4d2f-8cb9-1b049606e019","resolution":{"observed_at":"2026-08-09T12:06:20.417142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.959720Z","title":null,"venue":null,"work_id":"6cd88ccb-3384-4881-8bcf-e471c7729def","year":2020},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.424035Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:ba86e12b4d0ad4e74ea900caf3293a9153b4bd47ed71ed069c73dbd9889b1eeb","observation_id":"16ad6c04-3058-478a-adbd-26fdba486654","resolution":{"observed_at":"2026-08-09T12:06:20.964184Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.13465","last_updated":"2020-04-28T13:01:38Z","snapshot_observed_at":"2026-08-08T13:59:49.702216Z","submitted_at":"2020-04-28T13:01:38Z","title":"Nearly Optimal Regret for Stochastic Linear Bandits with Heavy-Tailed Payoffs","version":1},"cited_work":{"arxiv_id":"2004.13465","doi":null,"metadata_source":"pith","pith_arxiv_id":"2004.13465","snapshot_observed_at":"2026-08-09T12:06:20.758525Z","title":"Nearly Optimal Regret for Stochastic Linear Bandits with Heavy-Tailed Payoffs","venue":"cs.LG","work_id":"7141a2a4-7bea-4ec7-94cd-642568cbbc17","year":2020},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.429874Z"},"links":{"cited_paper":"/paper/2004.13465","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:9cf82234bfbab4cfb5579fce3b7062168127c4756fed80e39fa5fc874c07d140","observation_id":"0ece84ef-eaf1-49ed-bb16-12d98a199311","resolution":{"observed_at":"2026-08-09T12:06:20.763222Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08991","last_updated":"2024-07-20T15:23:25Z","snapshot_observed_at":"2026-08-16T14:18:44.544700Z","submitted_at":"2024-02-14T07:27:30Z","title":"Towards Robust Model-Based Reinforcement Learning Against Adversarial Corruption","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08991","snapshot_observed_at":"2026-08-09T12:06:20.434468Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.434468Z"},"links":{"cited_paper":"/paper/2402.08991","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:b9a7b4f8dc3b28065796592465e2e751c9ea285fef34328969401d906eeaa847","observation_id":"0626df87-5020-44cd-bd9e-b2b1614a23c1","resolution":{"observed_at":"2026-08-09T12:06:20.434468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.440710Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.440710Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:1223795a8fa21ac706a86b78b03d66757fcd4f56e819cee1441413e5faf99b58","observation_id":"ec77caab-5c9f-4390-a1e3-58e13d744745","resolution":{"observed_at":"2026-08-09T12:06:20.440710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.932144Z","title":null,"venue":null,"work_id":"5a02f21d-9d7c-4cf9-8cbf-33caa35c0377","year":2024},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.450109Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:2228aba9d8aa7f4e7dc757dfe1f1055a3d43079398431948fe94cdc48c8d019a","observation_id":"6aa46686-cbc8-4f83-bc8d-9452a544e64a","resolution":{"observed_at":"2026-08-09T12:06:20.938143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.917801Z","title":null,"venue":null,"work_id":"16dd641e-496c-4360-85e1-1fb3e97d14d8","year":2023},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.458660Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:300d24f0077a757cc6e631ac02971a2bfb20bdf133dd6089646a7a1be824d791","observation_id":"fc5ef3ee-7a32-4c6c-871b-8e833529be12","resolution":{"observed_at":"2026-08-09T12:06:20.922508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.904545Z","title":null,"venue":null,"work_id":"c34d8608-fb83-4709-899d-1484c9916c89","year":2023},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.462987Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:fd1e91ff090a4e6f24d4a527aa602009b335e03c23f5081c9e0e2934f67f76ad","observation_id":"bbd8488d-a755-4439-a75f-764ed5f052d2","resolution":{"observed_at":"2026-08-09T12:06:20.909191Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.890033Z","title":null,"venue":null,"work_id":"5dbcd34d-f113-430b-9e62-0e07881cb897","year":2021},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.468023Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:7bc3ba660c7232cbb843a36567e8f6341a27728ae2730bbf655f1b81e0252359","observation_id":"0d9ce622-ddb8-4814-aca3-8376b7b64f53","resolution":{"observed_at":"2026-08-09T12:06:20.894884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.472369Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.472369Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:9616f7c74f250ae619bc215460185dcdefaf8e3a80ea1a114ef39b96fd8686cc","observation_id":"a9c2316d-8592-4ce6-8a35-3bfd8612935e","resolution":{"observed_at":"2026-08-09T12:06:20.472369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.876510Z","title":null,"venue":null,"work_id":"31fb7469-03b5-4b6d-9d17-c9218bba5e0b","year":2023},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.476482Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:26d5adc972dad667f210267c5d226d869a901d60a78737c6f77c360373b928e1","observation_id":"3ae9286f-423a-4783-9275-fff8d5287511","resolution":{"observed_at":"2026-08-09T12:06:20.880942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11507","last_updated":"2022-05-23T17:59:18Z","snapshot_observed_at":"2026-08-16T16:58:18.997694Z","submitted_at":"2022-05-23T17:59:18Z","title":"Computationally Efficient Horizon-Free Reinforcement Learning for Linear Mixture MDPs","version":1},"cited_work":{"arxiv_id":"2205.11507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.11507","snapshot_observed_at":"2026-08-09T12:06:20.526457Z","title":"Computationally Efficient Horizon-Free Reinforcement Learning for Linear Mixture MDPs","venue":"cs.LG","work_id":"4ca075a8-dd1e-4623-877b-b4f06f10557c","year":2022},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.481935Z"},"links":{"cited_paper":"/paper/2205.11507","citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:d89d688326e5abac9a4220f30cd9a66d92be7d687e5a3494b1c8d2d9fee0b4df","observation_id":"25f15fd8-a4a5-4487-9e0b-e86681fd50a7","resolution":{"observed_at":"2026-08-09T12:06:20.533550Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:06:20.863211Z","title":null,"venue":null,"work_id":"c0e41c98-a390-4210-b85b-fa00c50244a8","year":2021},"citing_paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T12:06:20.486932Z"},"links":{"citing_paper":"/paper/2502.02486"},"observation_digest":"sha256:de7e4f3618d706fe2a2b91cd5652d47423d950e24246dd564117984bdd8af9a9","observation_id":"b39f8a24-8f3d-4d57-b6a1-72101e6dad0e","resolution":{"observed_at":"2026-08-09T12:06:20.867668Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.02486","last_updated":"2025-02-04T17:03:32Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-10T00:13:28.338045Z","submitted_at":"2025-02-04T17:03:32Z","title":"Catoni Contextual Bandits are Robust to Heavy-tailed Rewards"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":5,"verified_fuzzy":7},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2502.02486."}