{"as_of":"2026-08-20T10:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2bde1ecc99e28dd63ee5416fce03b489c439c16df50e5d53108fbd214b853c41","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:40:25.802672Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.12086/citation-record","integrity":"/paper/2504.12086/integrity","json":"/paper/2504.12086/citation-record.json","paper":"/paper/2504.12086"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.343308Z","title":"Contextual bandits for adapting treatment in a mouse model of de novo carcinogenesis,","venue":null,"work_id":"b37695e9-18cd-43d0-b533-e34705471bbc","year":2018},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.608835Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:681bdda0c2cfd9f6261208fd50e0ae82d8aab43703c40af5f280111f102fb208","observation_id":"7ba0bba0-6cc6-453e-87ff-23776cd3eb7f","resolution":{"observed_at":"2026-08-16T12:40:26.348548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.324561Z","title":"Portfolio choices with orthogonal bandit learning,","venue":null,"work_id":"4aaf0c56-92b4-4c6d-8fdb-5a296564f530","year":2015},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.616865Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:6f80ecbf6ca52e091f117428c2796803401d42a368c5b97bd1cd4b0d7c21e565","observation_id":"19252618-1418-4d7e-aa36-d9295ca0b088","resolution":{"observed_at":"2026-08-16T12:40:26.330799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.307035Z","title":"Explore, exploit, and explain: personalizing explainable recommendations with bandits,","venue":null,"work_id":"4be18975-7c41-4aaf-9696-017ab525d620","year":2018},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.627377Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:73d50a3cddaece20225b75777bc499c777b5f3305431f2dab7245054919f1c00","observation_id":"f2be6d95-df3a-4cbe-9ed5-23c3ba6f06fc","resolution":{"observed_at":"2026-08-16T12:40:26.313065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.289001Z","title":"Distributed stochastic contextual bandits for protein drug interaction,","venue":null,"work_id":"e85d4fa8-ec5e-46d5-8fa8-9a5cc9680054","year":2024},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.636138Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:50b208a36e22f06214706fd90c501b556fc01222697bc05a224869ca0d23ee81","observation_id":"d52d808c-38ca-403c-8a64-4b785864be23","resolution":{"observed_at":"2026-08-16T12:40:26.294425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.270714Z","title":"Stochastic conservative contextual linear bandits,","venue":null,"work_id":"5c775b90-c0ca-4291-ac81-b28d55ac0944","year":2022},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.644988Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:31d68d9f5e0431d3161c60368c7590bd587d84bb0de0b7c777df326b75e164e7","observation_id":"a2057726-b10c-461e-9f58-812ae0627c36","resolution":{"observed_at":"2026-08-16T12:40:26.276877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.253557Z","title":"Contextual bandits with linear payoff functions,","venue":null,"work_id":"b1dbc5dd-8735-430f-944c-c66527aac63d","year":2011},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.654082Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:53c7538f64d712331076f674f80ee0d0e5abe04302a8286d7572b8efc9883512","observation_id":"dbec7f8d-8094-48cb-92a6-fa2967371f81","resolution":{"observed_at":"2026-08-16T12:40:26.259691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.235044Z","title":"Thompson sampling for contextual bandits with linear payoffs,","venue":null,"work_id":"836350dc-9bac-48ed-a6d5-95dbefd23250","year":2013},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.662350Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:f509a2c9ab1a880967a2987c7d9438741d7028a283f35d73e967664c5d5ecdb5","observation_id":"bb0b47fe-6423-4da0-8497-a9d7d1f73ef1","resolution":{"observed_at":"2026-08-16T12:40:26.242092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.214560Z","title":"Parametric bandits: The generalized linear case,","venue":null,"work_id":"6afc18df-9fe1-4566-b8c5-715690e86b89","year":2010},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.669438Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:1ee68334b237861121e6c5b0307d350957b78f9d8746aeb47ab891ff4e1b8af5","observation_id":"9b05e0e9-cfeb-493a-82b4-adeda297dc82","resolution":{"observed_at":"2026-08-16T12:40:26.220372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.194099Z","title":"Neural contextual bandits with ucb- based exploration,","venue":null,"work_id":"e25ca396-8197-4058-8de6-2950938820b1","year":2020},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.679701Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:bb738769c6640cf06309adcf8e2f3533c49702e8b725037463f92348b73278db","observation_id":"eecf99a5-5b86-4165-a5f8-859110c3b905","resolution":{"observed_at":"2026-08-16T12:40:26.201501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00827","last_updated":"2021-12-30T09:21:04Z","snapshot_observed_at":"2026-08-16T19:16:23.498911Z","submitted_at":"2020-10-02T07:44:09Z","title":"Neural Thompson Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00827","snapshot_observed_at":"2026-08-16T12:40:25.687333Z","title":"Neural thompson sampling,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.687333Z"},"links":{"cited_paper":"/paper/2010.00827","citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:2547423339648bd0498778747ec6cfa17ce76b71dd838741a3ab71fb5034bcb6","observation_id":"0b5cf425-d81e-4ac5-8176-09540c4669f7","resolution":{"observed_at":"2026-08-16T12:40:25.687333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.173404Z","title":"Online learning under delayed feedback,","venue":null,"work_id":"9bb674bb-c2c6-407d-8e59-87b27b0bba47","year":2013},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.695439Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:b39b4a77fe68efdd6d66c819ae69476991a0dee32f3a1f1e976a083fa8bcb64d","observation_id":"38713bc1-ab0b-4dd7-8186-06e1c0fb2af2","resolution":{"observed_at":"2026-08-16T12:40:26.179651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.152492Z","title":"Ban- dits with delayed, aggregated anonymous feedback,","venue":null,"work_id":"bfefde86-2f35-4642-9607-cbefcbca002a","year":2018},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.706791Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:e9570612601d19551de369d0bde98fd5f0987a572a489cb66a21b2b90d81e8a4","observation_id":"89274bd1-318e-461b-972b-20a040d6825e","resolution":{"observed_at":"2026-08-16T12:40:26.159216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.09186","last_updated":"2017-07-12T09:12:56Z","snapshot_observed_at":"2026-08-14T20:51:09.196458Z","submitted_at":"2017-06-28T09:43:46Z","title":"Stochastic Bandit Models for Delayed Conversions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.09186","snapshot_observed_at":"2026-08-16T12:40:25.714456Z","title":"Stochastic bandit models for delayed conversions,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.714456Z"},"links":{"cited_paper":"/paper/1706.09186","citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:1f9321d727e797b3a37d8f7cb0714e5e9e62d36c625124d2edbc387ef8aa263e","observation_id":"cd9f3543-2ebe-4533-9f8b-06c5efc1a31c","resolution":{"observed_at":"2026-08-16T12:40:25.714456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.132539Z","title":"The queue method: Handling delay, heuristics, prior data, and evaluation in ban- dits,","venue":null,"work_id":"e13f0eba-c875-4bbf-a123-5737111d9de0","year":2015},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.722016Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:64eb56d75f1fda940e8d441062b9ac12358dfa861030d851c987612504ec3e33","observation_id":"8a7188dc-7132-4fb2-a4d9-a992d4cb03ef","resolution":{"observed_at":"2026-08-16T12:40:26.139560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.108656Z","title":"Learning in generalized linear contextual bandits with stochastic delays,","venue":null,"work_id":"ff086ef0-2bd1-4de9-8559-78d4468f93c2","year":2019},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.729135Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:698e24c74caf07e8d36f3c6bb7395508e9c6717f74caab5a22ed00c545ba12de","observation_id":"c518b430-1d72-4f1c-8ed8-cd9ec69365d3","resolution":{"observed_at":"2026-08-16T12:40:26.116687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.088554Z","title":"Delay-adaptive learning in general- ized linear contextual bandits,","venue":null,"work_id":"f0bb5da8-1e79-41e0-bb9a-eecff101fe1a","year":2024},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.735219Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:3d4b4e58e3250bcc4fb06e32abb5eff032ea17ad8a2e4ae04412044a67df2f07","observation_id":"86676cc0-6056-4df4-89a4-2def6199a1a0","resolution":{"observed_at":"2026-08-16T12:40:26.093839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.068349Z","title":"Delayed feedback in generalised linear bandits revisited,","venue":null,"work_id":"e789793e-2658-41f4-b2f0-52f5b060739f","year":2023},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.741501Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:980e3bdec1bb183d23afe0ab60e60ed5c774d5e7533da8dfb513004332c3f857","observation_id":"bf745955-0369-466f-8a3c-5284657e8b76","resolution":{"observed_at":"2026-08-16T12:40:26.074234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.047627Z","title":"Neural contextual bandits without regret,","venue":null,"work_id":"dcc41b4b-1161-4d46-9c2e-c6950794b4c1","year":2022},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.748587Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:41911fdc680ff526218a010e5424dba2ba0364a8b41a0c5c76d5a4d4b926d3b8","observation_id":"2e3d86f6-318e-417b-9cd2-9c76e865d9cb","resolution":{"observed_at":"2026-08-16T12:40:26.054396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.01780","last_updated":"2020-12-03T09:17:55Z","snapshot_observed_at":"2026-08-16T19:01:19.319539Z","submitted_at":"2020-12-03T09:17:55Z","title":"Neural Contextual Bandits with Deep Representation and Shallow Exploration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.01780","snapshot_observed_at":"2026-08-16T12:40:25.755507Z","title":"Neural contextual bandits with deep representation and shallow exploration,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.755507Z"},"links":{"cited_paper":"/paper/2012.01780","citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:95758b17200ae4d103a99e72b555668d1a81d9bedf2b887e101db5ff8c927def","observation_id":"32089fbb-6d87-4fe6-8d82-276084a8076c","resolution":{"observed_at":"2026-08-16T12:40:25.755507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.027622Z","title":"Scalable neural contextual bandit for recommender systems,","venue":null,"work_id":"609d8648-e54d-415f-9f1d-a804cc6d43ab","year":2023},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.762608Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:c22e1f71125b7556d0980c6b6c3847ea481e2d512734c3b6289671b5e4369f5c","observation_id":"3eec0900-252c-4056-8e2f-e6f83b378c47","resolution":{"observed_at":"2026-08-16T12:40:26.033886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:26.008252Z","title":"Provably and practically efficient neural contextual ban- dits,","venue":null,"work_id":"81e7fb57-bd4b-443f-b1d9-50f337afa8b8","year":2023},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.770001Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:c1410b0e18ca87d749dc4e99b0ff82c56fde2bd8cb344ddb2076a8cc06385307","observation_id":"12144bdc-a3ad-43d6-9d58-06733e153b88","resolution":{"observed_at":"2026-08-16T12:40:26.015019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:25.779534Z","title":"Neural tangent kernel: Con- vergence and generalization in neural networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.779534Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:6efd51306e6e9570f9c4461c6053c398a241c7b6ebc7d8867f8055648b3066a7","observation_id":"a2efb03e-bffe-4fe7-864b-038c3e6785b2","resolution":{"observed_at":"2026-08-16T12:40:25.779534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:25.963397Z","title":"Improved algorithms for linear stochastic bandits,","venue":null,"work_id":"123c6b28-7861-47fd-9739-7036d220811f","year":2011},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.786873Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:6a7d549de96650d1899173806be8255109a89ad0063a98eb6a6180fccdb8ed4e","observation_id":"61cea465-6e3c-404a-a3ae-59955f127bda","resolution":{"observed_at":"2026-08-16T12:40:25.978044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:25.795238Z","title":"Gradient-based learning applied to document recognition,","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.795238Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:896e65f52f50db51dddbafad749de0e108021e6bd4cbcaf7533947a00ae85dc1","observation_id":"71404d93-2dd7-4be9-9000-ebd73e8f81b9","resolution":{"observed_at":"2026-08-16T12:40:25.795238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:40:25.802672Z","title":"Mushroom","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T12:40:25.802672Z"},"links":{"citing_paper":"/paper/2504.12086"},"observation_digest":"sha256:c2d0594b26a3dbbc00128b5af1097d9537361c9a7af1878ffed710f9454c640c","observation_id":"96c7c7a2-877f-4b2e-af69-658004aee6e4","resolution":{"observed_at":"2026-08-16T12:40:25.802672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.12086","last_updated":"2025-04-16T13:47:25Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T12:36:17.933685Z","submitted_at":"2025-04-16T13:47:25Z","title":"Neural Contextual Bandits Under Delayed Feedback Constraints"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2504.12086."}