{"as_of":"2026-08-17T22:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9d90cddae0103378246329e31ee314210ec1931c422419d2689fd9706d2fb661","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:54:06.521394Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.09940/citation-record","integrity":"/paper/2506.09940/integrity","json":"/paper/2506.09940/citation-record.json","paper":"/paper/2506.09940"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.339035Z","title":"The causal structure of the transition sh+1 is the same asr h","venue":null,"work_id":"bc0fd316-e160-4a11-950a-989b14828ed1","year":2009},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.981598Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:7fe811c23fac1dffd691f443c723315dc35e7180a4a338718dd2b7234db9776c","observation_id":"0a304f26-af6d-4bd0-9bcc-aaabeb304e4c","resolution":{"observed_at":"2026-08-07T04:54:11.521993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03927","last_updated":"2022-09-08T17:08:12Z","snapshot_observed_at":"2026-08-16T16:33:49.627677Z","submitted_at":"2022-09-08T17:08:12Z","title":"Sequential Information Design: Learning to Persuade in the Dark","version":1},"cited_work":{"arxiv_id":"2209.03927","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.03927","snapshot_observed_at":"2026-08-07T04:54:09.997592Z","title":"Sequential Information Design: Learning to Persuade in the Dark","venue":"cs.LG","work_id":"93946bff-d998-4af9-8840-20f3bfd02bef","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.006936Z"},"links":{"cited_paper":"/paper/2209.03927","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:90ac71e71d5fcef77fce2d1c41a636d7a9c8e08f342514d7ae50e1e03921180f","observation_id":"a0893674-3196-4bef-8cfd-795a834e2683","resolution":{"observed_at":"2026-08-07T04:54:10.084054Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15634","last_updated":"2022-09-30T17:59:16Z","snapshot_observed_at":"2026-08-16T16:27:45.960193Z","submitted_at":"2022-09-30T17:59:16Z","title":"A General Framework for Sample-Efficient Function Approximation in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15634","snapshot_observed_at":"2026-08-07T04:54:02.731207Z","title":"J., Yuan, A., Gu, Q., and Jordan, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.731207Z"},"links":{"cited_paper":"/paper/2209.15634","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:9eccee1e59f34b4f9e0262a235074133d5d8df158666394df93bead8461ca632","observation_id":"ce103053-a1c5-4338-9e01-e38b1ffa5044","resolution":{"observed_at":"2026-08-07T04:54:02.731207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.04972","last_updated":"2021-03-08T18:51:00Z","snapshot_observed_at":"2026-08-16T18:40:24.157025Z","submitted_at":"2021-03-08T18:51:00Z","title":"Provably Efficient Cooperative Multi-Agent Reinforcement Learning with Function Approximation","version":1},"cited_work":{"arxiv_id":"2103.04972","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.04972","snapshot_observed_at":"2026-08-07T04:54:08.913189Z","title":"Provably Efficient Cooperative Multi-Agent Reinforcement Learning with Function Approximation","venue":"cs.LG","work_id":"338d8176-988d-486b-bb3a-c8005574e11a","year":2021},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.009237Z"},"links":{"cited_paper":"/paper/2103.04972","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:b33ebe91dde797481a1bf7fb656317242f99034546504f6fed8300fa9c8480da","observation_id":"e5e3c04d-62fe-44e0-98a9-05f8056cae3f","resolution":{"observed_at":"2026-08-07T04:54:09.068600Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.13487","last_updated":"2023-07-11T16:47:42Z","snapshot_observed_at":"2026-08-16T17:31:55.368873Z","submitted_at":"2021-12-27T02:53:44Z","title":"The Statistical Complexity of Interactive Decision Making","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.13487","snapshot_observed_at":"2026-08-07T04:54:03.157341Z","title":"J., Kakade, S","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.157341Z"},"links":{"cited_paper":"/paper/2112.13487","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:c5e51dff385ede4df6b3fb096348f6ab3e05a43f6c3a7adbe8997540a851d1c3","observation_id":"72a59660-db8a-49c2-aad2-4e1a3f2553bb","resolution":{"observed_at":"2026-08-07T04:54:03.157341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.608600Z","title":"and Goldberg, Y","venue":null,"work_id":"c7d67415-89d4-4891-b2ca-c0b6e2a71423","year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.294909Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:7d291193101f3751a0b26d7ee4a78515c8b74fd1e5df3eb0faf5fb27754812d8","observation_id":"b3f4eb6b-269b-44fd-baab-a75e0b3658d4","resolution":{"observed_at":"2026-08-07T04:54:12.777594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.01146","last_updated":"2024-02-14T02:35:48Z","snapshot_observed_at":"2026-08-16T16:35:04.872814Z","submitted_at":"2022-09-02T15:56:08Z","title":"Generalized Principal-Agency: Contracts, Information, Games and Beyond","version":2},"cited_work":{"arxiv_id":"2209.01146","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.01146","snapshot_observed_at":"2026-08-07T04:54:08.658488Z","title":"Generalized Principal-Agency: Contracts, Information, Games and Beyond","venue":"cs.GT","work_id":"1f020909-d2aa-4c26-b02e-e8d5497ebdd5","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.437949Z"},"links":{"cited_paper":"/paper/2209.01146","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:e1f23b5080dbf032c5778114dbc7c4e0f42289794ebd596d8f9793333eb36d41","observation_id":"e87ba1e4-72af-4e05-92d0-08a330b705ac","resolution":{"observed_at":"2026-08-07T04:54:08.765995Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13712","last_updated":"2024-08-20T02:31:25Z","snapshot_observed_at":"2026-08-16T14:52:29.515419Z","submitted_at":"2023-10-13T01:21:52Z","title":"Impact of Guidance and Interaction Strategies for LLM Use on Learner Performance and Perception","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13712","snapshot_observed_at":"2026-08-07T04:54:03.543461Z","title":"J., and Liut, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.543461Z"},"links":{"cited_paper":"/paper/2310.13712","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:88c5c420da95bf05db3740b695755090e094557ec929bb9655cc119241997b83","observation_id":"fde7464f-4a58-42df-ac9e-536ec1d70442","resolution":{"observed_at":"2026-08-07T04:54:03.543461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.378759Z","title":null,"venue":null,"work_id":"c5e0d6bd-8c2d-4b96-b73d-3647d9c6d712","year":1994},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.769226Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:c8f3cb25a7692d243f249e8a18ed91274b761acf4098cc87236f1e53b8792214","observation_id":"eea964c4-a3c9-412d-bec4-87c7a08c0382","resolution":{"observed_at":"2026-08-07T04:54:12.463390Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.10502","last_updated":"2021-09-22T03:36:51Z","snapshot_observed_at":"2026-08-16T17:54:58.428726Z","submitted_at":"2021-09-22T03:36:51Z","title":"A Spectral Approach to Off-Policy Evaluation for POMDPs","version":1},"cited_work":{"arxiv_id":"2109.10502","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.10502","snapshot_observed_at":"2026-08-07T04:54:07.536685Z","title":"A Spectral Approach to Off-Policy Evaluation for POMDPs","venue":"cs.LG","work_id":"4d0e922b-d088-4937-986d-09b01ec1c066","year":2021},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:04.362447Z"},"links":{"cited_paper":"/paper/2109.10502","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:601066a908a0d989689345620f9d646b1d065bd9da0ffb5b14da4e9fb56ad71f","observation_id":"e1ad7928-2e4d-4f21-a123-e56cc1018896","resolution":{"observed_at":"2026-08-07T04:54:07.688057Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.13081","last_updated":"2023-11-14T22:16:28Z","snapshot_observed_at":"2026-08-16T16:43:10.358005Z","submitted_at":"2022-07-26T17:53:29Z","title":"Future-Dependent Value-Based Off-Policy Evaluation in POMDPs","version":2},"cited_work":{"arxiv_id":"2207.13081","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.13081","snapshot_observed_at":"2026-08-07T04:54:06.992916Z","title":"Future-Dependent Value-Based Off-Policy Evaluation in POMDPs","venue":"cs.LG","work_id":"dd9efded-845e-415b-99db-cc927c1cfdae","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:04.661647Z"},"links":{"cited_paper":"/paper/2207.13081","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:21b9e1e9c851231cf8b1c296b013ed9d681e5b21109ac8e8b949f0ba90973291","observation_id":"6f5b7b01-83d2-4ece-877e-60aa6745c19a","resolution":{"observed_at":"2026-08-07T04:54:07.118747Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.06309","last_updated":"2019-05-29T02:05:10Z","snapshot_observed_at":"2026-08-14T16:47:20.727448Z","submitted_at":"2019-04-12T16:32:17Z","title":"Distributed Bandit Learning: Near-Optimal Regret with Efficient Communication","version":2},"cited_work":{"arxiv_id":"1904.06309","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.06309","snapshot_observed_at":"2026-08-07T04:54:06.693850Z","title":"Distributed Bandit Learning: Near-Optimal Regret with Efficient Communication","venue":"cs.LG","work_id":"98c9678a-1d22-460c-b5d7-0e2b2345a25c","year":2019},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:04.786705Z"},"links":{"cited_paper":"/paper/1904.06309","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:e809b6a972fd69dcd3f0771fdf82e7fb0fb39bd92e224f51afd83948a1692897","observation_id":"934db6f4-644f-4424-90c5-2aa261c47055","resolution":{"observed_at":"2026-08-07T04:54:06.868256Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.10678","last_updated":"2022-02-22T05:41:43Z","snapshot_observed_at":"2026-08-17T22:28:29.001851Z","submitted_at":"2022-02-22T05:41:43Z","title":"Sequential Information Design: Markov Persuasion Process and Its Efficient Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.10678","snapshot_observed_at":"2026-08-07T04:54:04.936385Z","title":"I., and Xu, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:04.936385Z"},"links":{"cited_paper":"/paper/2202.10678","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:79351161a565c088106926dca40ea1e8497f0d5cda7c7cb98d46832a1f3c3447","observation_id":"2622d014-63f5-40d7-9a54-1cfd3b172673","resolution":{"observed_at":"2026-08-07T04:54:04.936385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.11040","last_updated":"2022-08-23T15:32:44Z","snapshot_observed_at":"2026-08-16T17:04:21.713910Z","submitted_at":"2022-08-23T15:32:44Z","title":"Strategic Decision-Making in the Presence of Information Asymmetry: Provably Efficient RL with Algorithmic Instruments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.11040","snapshot_observed_at":"2026-08-07T04:54:05.048804Z","title":"Strategic decision-making in the presence of information asymmetry: Provably ef- ficient rl with algorithmic instruments.arXiv preprint arXiv:2208.11040,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.048804Z"},"links":{"cited_paper":"/paper/2208.11040","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:afa88630d0f1c7854b17688f27006f1dbdbe768d2755062d55c8bcf856764a36","observation_id":"70a35387-73a2-43dc-b593-10034929719e","resolution":{"observed_at":"2026-08-07T04:54:05.048804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.13521","last_updated":"2021-12-27T05:41:14Z","snapshot_observed_at":"2026-08-16T17:31:54.542213Z","submitted_at":"2021-12-27T05:41:14Z","title":"Can Reinforcement Learning Find Stackelberg-Nash Equilibria in General-Sum Markov Games with Myopic Followers?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.13521","snapshot_observed_at":"2026-08-07T04:54:05.164140Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.164140Z"},"links":{"cited_paper":"/paper/2112.13521","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:d49cfa6e53012b420c19d5acf287291d95e59fa2492f5def20458f437036ada7","observation_id":"397c7713-7dff-4a4c-9669-ab4428628ab2","resolution":{"observed_at":"2026-08-07T04:54:05.164140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01962","last_updated":"2023-06-30T13:05:42Z","snapshot_observed_at":"2026-08-16T16:18:48.549126Z","submitted_at":"2022-11-03T16:42:40Z","title":"GEC: A Unified Framework for Interactive Decision Making in MDP, POMDP, and Beyond","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01962","snapshot_observed_at":"2026-08-07T04:54:05.290336Z","title":"A posterior sampling frame- work for interactive decision making.arXiv preprint arXiv:2211.01962,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.290336Z"},"links":{"cited_paper":"/paper/2211.01962","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:8e6cd498dcc5510d50db730b65cc5b43cf263419b18b435d5bd994bfd6f3205a","observation_id":"0774341a-012a-440c-bddb-28ef5f3eb085","resolution":{"observed_at":"2026-08-07T04:54:05.290336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.230892Z","title":"Notation Table For the convenience of the reader, we summarize the notations in the paper as a notation table","venue":null,"work_id":"a4d4ce8a-c580-45b7-b584-dae27925abc0","year":2018},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.422440Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:d0882347e22e34a7771bff8470d8d052df2f8dddb3a9cd5977484a06106cc0c2","observation_id":"d56982cc-0085-434d-a31b-9af0ef59ffa4","resolution":{"observed_at":"2026-08-07T04:54:12.308788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.108303Z","title":null,"venue":null,"work_id":"e68cfc6e-d4d2-44ad-87d7-5e43d3abe209","year":2013},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.588600Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:1b91effad60413567bcb2b37b9468b961cdfa898f0c6d479a86709ba7d263dd4","observation_id":"aed164c0-13e0-416c-88e5-17b764dea9cf","resolution":{"observed_at":"2026-08-07T04:54:12.161611Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.684305Z","title":null,"venue":null,"work_id":"74e4490a-33da-43d2-9127-904901154864","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.846040Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:2d8017da702344de8e421a61551c0c9ff99602e19ce176697705bc7095ef0d79","observation_id":"90caff52-f96f-416f-ae2f-2aa4fbccf611","resolution":{"observed_at":"2026-08-07T04:54:11.811749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.021629Z","title":"Section 4.1) and the dynamical transition class (see Section D.1)","venue":null,"work_id":"0d0896a7-2581-43b1-9fb3-8dc25990f645","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:06.105483Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:a49c18f6fbc39130f970f438744d2b28aca896dff0fdf6644fdb14a97adf2e40","observation_id":"00a46fb7-3e40-46e3-8060-8adc3e61b57d","resolution":{"observed_at":"2026-08-07T04:54:11.177643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:10.824771Z","title":null,"venue":null,"work_id":"38d2914a-ac79-422a-9e3b-9e3b0004d2be","year":2021},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:06.249836Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:c956005d413fa47352bd4edd3490056300e8c3c210038a6fe537fdacc2d17ee6","observation_id":"138a270b-83d2-4f00-bc7c-cb790fe5fe33","resolution":{"observed_at":"2026-08-07T04:54:10.945201Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:10.505480Z","title":"Denote the least-square estimator of f ∗ by ˆf, standard analysis allows us to bound the projected Mean Squared Error (pMSE) EW EX,Y h Y− ˆf(X)|W i2","venue":null,"work_id":"ec4d3aa0-7218-4791-b4f9-44e87fdee3ae","year":2014},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:06.403117Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:e5f647a9f95a4a51fbd2b4ff142f1ba04a06eae06f4119a459b59b4413c36534","observation_id":"673bdefd-9a66-4539-ac0d-de610111fbf5","resolution":{"observed_at":"2026-08-07T04:54:10.671170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.01866","last_updated":"2020-01-09T19:08:09Z","snapshot_observed_at":"2026-08-11T23:21:08.502885Z","submitted_at":"2020-01-07T02:59:59Z","title":"Reinforcement Learning via Fenchel-Rockafellar Duality","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.01866","snapshot_observed_at":"2026-08-07T04:54:04.252289Z","title":"and Dai, B","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":1982,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:04.252289Z"},"links":{"cited_paper":"/paper/2001.01866","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:cf58b346fa95fbc7b1fb0e46e0b250448826a6099aed7899c4a78a31f5044158","observation_id":"2c57ecf3-d9cf-4bd4-b63f-5712208a686c","resolution":{"observed_at":"2026-08-07T04:54:04.252289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.07035","last_updated":"2022-06-21T21:34:58Z","snapshot_observed_at":"2026-08-16T18:45:45.140905Z","submitted_at":"2021-02-14T00:06:54Z","title":"Model-free Representation Learning and Exploration in Low-rank MDPs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.07035","snapshot_observed_at":"2026-08-07T04:54:04.093965Z","title":"Model-free representation learning and exploration in low-rank mdps.arXiv preprint arXiv:2102.07035,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":1984,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:04.093965Z"},"links":{"cited_paper":"/paper/2102.07035","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:378742c60e40efb2419d5e1cb337fe927d0a42f00d6c6af81b26611320ce63c4","observation_id":"a31f4c4b-8e59-420d-959d-4bca75f21e2f","resolution":{"observed_at":"2026-08-07T04:54:04.093965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08967","last_updated":"2022-05-24T18:53:45Z","snapshot_observed_at":"2026-08-16T17:06:02.475482Z","submitted_at":"2022-04-19T16:08:28Z","title":"When Is Partially Observable Reinforcement Learning Not Scary?","version":2},"cited_work":{"arxiv_id":"2204.08967","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.08967","snapshot_observed_at":"2026-08-07T04:54:08.020462Z","title":"When Is Partially Observable Reinforcement Learning Not Scary?","venue":"cs.LG","work_id":"19abff3f-a3eb-491c-a968-b02d2172d692","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":1994,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.882330Z"},"links":{"cited_paper":"/paper/2204.08967","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:ffddf813249429407de0a4b3bfdd4665890183844c62de1c9f74d4c5a9315c9c","observation_id":"484eed63-23fc-40fc-adec-020a11fac100","resolution":{"observed_at":"2026-08-07T04:54:08.160563Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:13.209838Z","title":"and Urner, R","venue":null,"work_id":"ac6361b7-6d96-48f3-9bf2-02071ad4aab8","year":2012},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":1998,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.666375Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:c7b38c567e76f1184be0d053a6eea83fedf67f872192fcd1a5de368eea9d2050","observation_id":"01574dc7-f2af-408e-afcb-3b1baf6abd76","resolution":{"observed_at":"2026-08-07T04:54:13.329279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.948926Z","title":"RL with confounders.Our work is also related to RL with confounders, as the private type th acts as an unobserved confounder in the strategic interaction model","venue":null,"work_id":"428787c2-fb13-4144-8c47-6e4494679ffd","year":2011},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2003,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:05.715325Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:1e7201717ac97af0429bbe1962cd21bb88070185f10e3aefd524d105c05197c0","observation_id":"f81925d8-6bb7-4d7b-b791-0c39d52cd761","resolution":{"observed_at":"2026-08-07T04:54:12.038612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.06784","last_updated":"2022-06-15T21:52:05Z","snapshot_observed_at":"2026-08-17T10:15:02.698890Z","submitted_at":"2021-11-12T15:52:24Z","title":"A Minimax Learning Approach to Off-Policy Evaluation in Confounded Partially Observable Markov Decision Processes","version":4},"cited_work":{"arxiv_id":"2111.06784","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.06784","snapshot_observed_at":"2026-08-07T04:54:07.274233Z","title":"A Minimax Learning Approach to Off-Policy Evaluation in Confounded Partially Observable Markov Decision Processes","venue":"cs.LG","work_id":"02aa66fe-37ae-4dea-8b54-071e72009797","year":2021},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2005,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:04.503307Z"},"links":{"cited_paper":"/paper/2111.06784","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:8d51b1978ab81893579ea5b780ee8e19a83f01a570352179f2e3ef9ef71de6d3","observation_id":"af6cc5eb-9151-4625-ba36-1c0499f3bf84","resolution":{"observed_at":"2026-08-07T04:54:07.397002Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03852","last_updated":"2024-07-19T11:35:43Z","snapshot_observed_at":"2026-08-16T16:25:58.843408Z","submitted_at":"2022-10-07T23:55:51Z","title":"Stackelberg POMDP: A Reinforcement Learning Approach for Economic Design","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03852","snapshot_observed_at":"2026-08-07T04:54:02.141846Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2007,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.141846Z"},"links":{"cited_paper":"/paper/2210.03852","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:14a74be39470476b612c72ffcc961c519d55d64b603c22bce53b3a9b8c024e1f","observation_id":"b6c06909-c5f1-4df3-a818-a6813dfe345f","resolution":{"observed_at":"2026-08-07T04:54:02.141846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.03244","last_updated":"2022-03-13T07:22:13Z","snapshot_observed_at":"2026-08-16T17:51:14.131794Z","submitted_at":"2021-10-07T07:59:50Z","title":"Near-Optimal Reward-Free Exploration for Linear Mixture MDPs with Plug-in Solver","version":4},"cited_work":{"arxiv_id":"2110.03244","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.03244","snapshot_observed_at":"2026-08-07T04:54:09.205923Z","title":"Near-Optimal Reward-Free Exploration for Linear Mixture MDPs with Plug-in Solver","venue":"cs.LG","work_id":"ab48c434-46e5-476c-86ba-8697555e54a0","year":2021},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.600821Z"},"links":{"cited_paper":"/paper/2110.03244","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:66c98e96fd1f00ec71721f6c882c030e405c85f883afbfdd4c6fedaaf5673146","observation_id":"0551c6a1-d9c2-493b-9313-e1215ae844d6","resolution":{"observed_at":"2026-08-07T04:54:09.323072Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.06169","last_updated":"2022-06-27T02:34:13Z","snapshot_observed_at":"2026-08-16T17:28:00.613485Z","submitted_at":"2022-01-17T01:09:38Z","title":"On Well-posedness and Minimax Optimal Rates of Nonparametric Q-function Estimation in Off-policy Evaluation","version":3},"cited_work":{"arxiv_id":"2201.06169","doi":null,"metadata_source":"pith","pith_arxiv_id":"2201.06169","snapshot_observed_at":"2026-08-07T04:54:09.441738Z","title":"On Well-posedness and Minimax Optimal Rates of Nonparametric Q-function Estimation in Off-policy Evaluation","venue":"math.ST","work_id":"2e477a71-2d30-4af2-9294-0c632155b3fc","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.462387Z"},"links":{"cited_paper":"/paper/2201.06169","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:e5c26538c747fe1c86313c345b376c71471286a63069ddbec0c5550b9641fd5a","observation_id":"69d66a50-b79c-45cd-888b-177460d542b2","resolution":{"observed_at":"2026-08-07T04:54:09.586681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.15332","last_updated":"2023-03-22T22:24:18Z","snapshot_observed_at":"2026-08-16T17:45:39.226581Z","submitted_at":"2021-10-28T17:46:14Z","title":"Proximal Reinforcement Learning: Efficient Off-Policy Evaluation in Partially Observed Markov Decision Processes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.15332","snapshot_observed_at":"2026-08-07T04:54:01.740262Z","title":"and Kallus, N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.740262Z"},"links":{"cited_paper":"/paper/2110.15332","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:08ceb8382c8b25fe4e5e55b555fb0bfc0ee5c3bc50cb053aed24ccd5b12bed6b","observation_id":"eb476f26-f3a0-424c-852f-3a73651be08b","resolution":{"observed_at":"2026-08-07T04:54:01.740262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:10.241927Z","title":null,"venue":null,"work_id":"0ca8ceec-40d6-4ec2-898e-d7127e84bf42","year":2011},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:06.521394Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:1633ec37e8073ddc0a5c9c3f35cdc9489ba4b5b4bac680423f9744aa07569daa","observation_id":"65ab6644-e237-471f-899c-80b272760fc7","resolution":{"observed_at":"2026-08-07T04:54:10.364098Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.08693","last_updated":"2023-10-22T20:59:12Z","snapshot_observed_at":"2026-08-14T18:11:56.849602Z","submitted_at":"2018-10-19T21:38:06Z","title":"The total variation distance between high-dimensional Gaussians with the same mean","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.08693","snapshot_observed_at":"2026-08-07T04:54:02.883224Z","title":"The total variation distance between high-dimensional gaussians","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.883224Z"},"links":{"cited_paper":"/paper/1810.08693","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:a0ca4c34e2c62a939ff1500bb64640dcca792f3f004bffc480a734e9e58b495a","observation_id":"20bbaf71-ffb4-404c-b55f-c53a9238e695","resolution":{"observed_at":"2026-08-07T04:54:02.883224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07822","last_updated":"2021-04-15T23:44:39Z","snapshot_observed_at":"2026-08-16T18:31:13.238256Z","submitted_at":"2021-04-15T23:44:39Z","title":"Estimating and Improving Dynamic Treatment Regimes With a Time-Varying Instrumental Variable","version":1},"cited_work":{"arxiv_id":"2104.07822","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.07822","snapshot_observed_at":"2026-08-07T04:54:09.704464Z","title":"Estimating and Improving Dynamic Treatment Regimes With a Time-Varying Instrumental Variable","venue":"stat.ME","work_id":"da834964-f369-4c76-a4c8-d25630c5dcaa","year":2021},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.296965Z"},"links":{"cited_paper":"/paper/2104.07822","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:23d99e28e589f66192a9f38b32c4ce0f8b16402e82e9218c91a49303957eecc0","observation_id":"e69212ad-7db0-444e-910e-9a518f081e0a","resolution":{"observed_at":"2026-08-07T04:54:09.838252Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.895452Z","title":"Off-policy evaluation in infinite-horizon reinforcement learning with latent confounders","venue":null,"work_id":"9cb16b1d-372b-44b4-8776-f62a4f794131","year":1999},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.875863Z"},"links":{"citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:63ed1d6663fd9bf8d42ac23cbeab1d1afaa9b33e3cd6054ea20b20904b1f643b","observation_id":"76fddd0e-11b6-4bfe-976a-9f2ac34a8790","resolution":{"observed_at":"2026-08-07T04:54:13.041692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.00046","last_updated":"2023-02-07T16:07:50Z","snapshot_observed_at":"2026-08-16T16:49:07.963765Z","submitted_at":"2022-06-30T18:26:03Z","title":"Performative Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2207.00046","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.00046","snapshot_observed_at":"2026-08-07T04:54:07.815412Z","title":"Performative Reinforcement Learning","venue":"cs.LG","work_id":"ac29a13d-9b4f-4e06-9c79-55564b6b013c","year":2022},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.995282Z"},"links":{"cited_paper":"/paper/2207.00046","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:9ede27d216d67b9838bcb76800c0fd8e8a7151cf697ed23948865dedc3ae7143","observation_id":"04cb86aa-8842-4d94-b8c9-3b8e85dbd73e","resolution":{"observed_at":"2026-08-07T04:54:07.903892Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09907","last_updated":"2024-10-14T22:26:38Z","snapshot_observed_at":"2026-08-16T18:44:26.186722Z","submitted_at":"2021-02-19T13:01:40Z","title":"Instrumental Variable Value Iteration for Causal Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2102.09907","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.09907","snapshot_observed_at":"2026-08-07T04:54:08.291306Z","title":"Instrumental Variable Value Iteration for Causal Offline Reinforcement Learning","venue":"stat.ML","work_id":"337fc120-d563-46a0-aa68-e36c657b52ee","year":2021},"citing_paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:03.658128Z"},"links":{"cited_paper":"/paper/2102.09907","citing_paper":"/paper/2506.09940"},"observation_digest":"sha256:544dbd1dd7484163c05afb2aa5c73efa0b9cf4c7219ad17fccd8ddc215abfc73","observation_id":"8fd8f01b-760c-4162-b371-c47fa63a0f77","resolution":{"observed_at":"2026-08-07T04:54:08.476679Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.09940","last_updated":"2025-06-11T17:06:57Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T02:45:08.342678Z","submitted_at":"2025-06-11T17:06:57Z","title":"The Sample Complexity of Online Strategic Decision Making with Information Asymmetry and Knowledge Transportability"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":13,"verified_fuzzy":8},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2506.09940."}