{"as_of":"2026-08-13T18:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f711211c51b3e83491625ec30af42f323f58a7d9d5042cf9257fd804df97c0b2","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T22:19:16.414341Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.23432/citation-record","integrity":"/paper/2607.23432/integrity","json":"/paper/2607.23432/citation-record.json","paper":"/paper/2607.23432"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.385728Z","title":"Bridging the gap between regret minimization and best arm identification, with application to a/b tests","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-13T01:20:53.182226Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.385728Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:2631d9b493ee6d3a4eb6d59aad8f28dc2829c5ec1bea277cec442934fd3ca883","observation_id":"1f27d64e-d5bb-4789-b875-b4f904d23209","resolution":{"observed_at":"2026-07-30T22:19:16.385728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.410080Z","title":"Therefore, we find that whenN < K1/3(T−N) 2/3, the instance-independent lower bound is Ω q K·(T−N) 2 N","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-13T01:20:53.182226Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.410080Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:8897d7a0eae965ee9b2892112a7c6f936a7b82536f6a4e1a04d7265a246f0b04","observation_id":"2999f7de-0df2-41a0-b9e1-664076d746d4","resolution":{"observed_at":"2026-07-30T22:19:16.410080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.414341Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-13T01:20:53.182226Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.414341Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:58fb75cec8e7125e5682a3b9063b0f63607396e0b1bbfb44bcbf81449c7a395d","observation_id":"7a4fe39a-f5b2-412d-9c03-631be5ad27c4","resolution":{"observed_at":"2026-07-30T22:19:16.414341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.374738Z","title":"doi: 10.1023/A: 1013689704352","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-13T01:20:53.182226Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.374738Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:b646e9ef132922ac3c8792c4bee8e85e7a0dd8b2c62d160d582f55467ca3a8e9","observation_id":"2573b3dc-1503-4e0d-8f2f-8b3718c81650","resolution":{"observed_at":"2026-07-30T22:19:16.374738Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07079","last_updated":"2022-02-14T22:58:13Z","snapshot_observed_at":"2026-08-13T16:40:48.625099Z","submitted_at":"2022-02-14T22:58:13Z","title":"Synthetically Controlled Bandits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07079","snapshot_observed_at":"2026-07-30T22:19:16.389455Z","title":"Synthetically controlled bandits","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-13T01:20:53.182226Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.389455Z"},"links":{"cited_paper":"/paper/2202.07079","citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:af238bd0631c6895b0e5eb48b0fe82116de132f2faff311111d50e0b119cb7d0","observation_id":"0ae4a0ee-641e-4b1d-b6b5-18d94d290788","resolution":{"observed_at":"2026-07-30T22:19:16.389455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.406817Z","title":"Best arm identification with minimal regret","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-13T01:20:53.182226Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.406817Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:21094c4e6878a37d35c3cf4206f92bf98d6bc938322420f78d2f1c7711e8dc66","observation_id":"40d14575-9f01-43c5-aebf-57827a67cc8c","resolution":{"observed_at":"2026-07-30T22:19:16.406817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10592","last_updated":"2024-07-30T08:48:04Z","snapshot_observed_at":"2026-08-13T04:17:40.956741Z","submitted_at":"2024-02-16T11:27:48Z","title":"Optimizing Adaptive Experiments: A Unified Approach to Regret Minimization and Best-Arm Identification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10592","snapshot_observed_at":"2026-07-30T22:19:16.396798Z","title":"Optimizing adaptive experiments: A unified approach to regret minimization and best-arm identification.arXiv preprint arXiv:2402.10592,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-13T01:20:53.182226Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.396798Z"},"links":{"cited_paper":"/paper/2402.10592","citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:5e905fc331b60902e49d89f88e6318c90899f6995b8bc5d9c837d0aee4d61acb","observation_id":"adf93f16-5f70-4a7e-a683-d333e664ed95","resolution":{"observed_at":"2026-07-30T22:19:16.396798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00096","last_updated":"2024-05-22T20:13:30Z","snapshot_observed_at":"2026-08-13T14:10:42.330563Z","submitted_at":"2023-05-31T18:15:09Z","title":"Learning the Pareto Front Using Bootstrapped Observation Samples","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00096","snapshot_observed_at":"2026-07-30T22:19:16.393248Z","title":"Learning the pareto front using bootstrapped observation samples.arXiv preprint arXiv:2306.00096,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-13T01:20:53.182226Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.393248Z"},"links":{"cited_paper":"/paper/2306.00096","citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:f862bb695697dbc3bfb5d7f6f71f79d56bbfc6306908cdb78a9ae4f06033e51b","observation_id":"9f56c8a0-aa6e-4094-a7b3-e2c783277adc","resolution":{"observed_at":"2026-07-30T22:19:16.393248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.382071Z","title":"Beatriz Pessoa de Araujo and Adam Robbins","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-13T01:20:53.182226Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.382071Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:8839067226ebac7e51a59dc3a8efb71277b9cee17e330344d59c039094530a12","observation_id":"9df464bf-26d5-43ef-a65e-f74c49757060","resolution":{"observed_at":"2026-07-30T22:19:16.382071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.370418Z","title":"Best arm identification in multi-armed bandits","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-13T01:20:53.182226Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.370418Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:1c01b5841423a889c70796075899872eecfc4083752832acd4f05e403d5a924a","observation_id":"79d53273-a44a-443d-815a-471d1456506c","resolution":{"observed_at":"2026-07-30T22:19:16.370418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.400186Z","title":"Regret distribution in stochastic bandits: Optimal trade-off between expectation and tail risk.arXiv preprint arXiv:2304.04341,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-13T01:20:53.182226Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.400186Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:1852f56dfdddf64a7ebefe808a45345e35e5148f2920598522bbfef7da21eb18","observation_id":"6ddb04e7-c24d-4527-859c-472354854044","resolution":{"observed_at":"2026-07-30T22:19:16.400186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.403687Z","title":"Accessed 2026- 01-31","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-13T01:20:53.182226Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.403687Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:18fd8bf00541c3b3ab0b2860879ab2057f7e8beef166c331483e7332e4cb82e2","observation_id":"209f9bef-8dcb-442f-b81e-6adc84ab2cd0","resolution":{"observed_at":"2026-07-30T22:19:16.403687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T22:19:16.378401Z","title":"Sébastien Bubeck, Rémi Munos, and Gilles Stoltz","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","snapshot_observed_at":"2026-08-13T01:20:53.182226Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-07-30T22:19:16.378401Z"},"links":{"citing_paper":"/paper/2607.23432"},"observation_digest":"sha256:0d71fc9e5d028116af32b0aa347051a81d096fc425555279cc26abc640d0bec9","observation_id":"44eaf60e-d5f9-4d3e-b8c7-9d3f8de089fb","resolution":{"observed_at":"2026-07-30T22:19:16.378401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.23432","last_updated":"2026-07-26T03:03:08Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T01:20:53.182226Z","submitted_at":"2026-07-26T03:03:08Z","title":"Short-Term Pain for Long-Term Gain: Adaptive Experiment with Post-Commitment Reward Shift"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2607.23432."}