{"as_of":"2026-08-09T20:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:118d4f33971d4a54fd97dede859865adfe7c75a4463b7e56a2436cdccb1083e2","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T03:13:36.890833Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25207/citation-record","integrity":"/paper/2607.25207/integrity","json":"/paper/2607.25207/citation-record.json","paper":"/paper/2607.25207"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:31.191949Z","title":"Prediction, Learning, and Games , publisher=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:31.191949Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:dfa8ad82f50e184481a564932922c96fc9c263c3fc8ce9db228ea223a6b4eb9f","observation_id":"c78a36d6-96ec-45fc-8059-a3b0b3e7399c","resolution":{"observed_at":"2026-08-01T03:13:31.191949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:31.295354Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:31.295354Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:201a4586201f32d3240ca796bd8608ff4119a0e4688b570018b31a1abb057cab","observation_id":"6d880f47-0710-4d93-b187-9de3413a2b55","resolution":{"observed_at":"2026-08-01T03:13:31.295354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:31.440706Z","title":"nature , volume=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:31.440706Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:8cebf60f91727e6fbfaf90330f255f20855bf5df9d1f473959427ee00fcac601","observation_id":"3ce33d30-f33d-4996-87ea-56a33c0c0db0","resolution":{"observed_at":"2026-08-01T03:13:31.440706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:31.585489Z","title":"nature , volume=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:31.585489Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:abf736d53660bd28d9e389f5e48b30ae4895aee82894a8d42ffd0266ac124ee4","observation_id":"85691db9-d25e-4550-8f00-40e4e11ee1dc","resolution":{"observed_at":"2026-08-01T03:13:31.585489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-01T03:13:31.761467Z","title":"arXiv preprint arXiv:2204.05862 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:31.761467Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:a21cc4544a5612867e2db5aa5d1cbeb2e66e43d62521c396d55b7419025389bc","observation_id":"60738b2c-093e-4eac-805d-6b9e8ca41564","resolution":{"observed_at":"2026-08-01T03:13:31.761467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:31.931403Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:31.931403Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:26d994bab55dbafc66a168176164f4274a79982f2e66d90b619e077f23a01f8a","observation_id":"604e4aac-a370-4e9e-af32-3292aa132386","resolution":{"observed_at":"2026-08-01T03:13:31.931403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:32.101246Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:32.101246Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:f9526ee220fd60b9157d91d20aa2c7d81f41569a61a8768820f22c4162aec686","observation_id":"215b63c6-c075-4f0e-9092-71429dcf8f71","resolution":{"observed_at":"2026-08-01T03:13:32.101246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:32.182117Z","title":"The International Journal of Robotics Research , volume=","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:32.182117Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:11f977e6a709dc29a66d450f24b9b93cf2bb3b9af4308521809021a47fe09154","observation_id":"00dfd0b6-c5fb-4e5e-8f73-43e442e2b744","resolution":{"observed_at":"2026-08-01T03:13:32.182117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:32.373208Z","title":"Manning and Stefano Ermon and Chelsea Finn , title =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:32.373208Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:2b2f41e971b6bd4a6fb3643e2355550cc412b12a4260e9e09fcc7dba5874503c","observation_id":"b7a81dde-0d1f-425c-ab19-c7a514719e2f","resolution":{"observed_at":"2026-08-01T03:13:32.373208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:32.502792Z","title":"Augmenting Online","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:32.502792Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:6c4148f96eb2ac70c229dd3b12b7185c88e3c0e105460f0bc2d486ee02daf2a9","observation_id":"fc077825-7e40-40ee-9c56-7a4ba0f25d0c","resolution":{"observed_at":"2026-08-01T03:13:32.502792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:32.626199Z","title":"International Conference on Artificial Intelligence and Statistics , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:32.626199Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:2ae5d31dd4bb0e1787178e7ff14565bbd19f22d117f4c86d1fe653f45404fd5b","observation_id":"7ba10fe0-12a0-4802-b3e1-8f9a7fbd99fa","resolution":{"observed_at":"2026-08-01T03:13:32.626199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:32.783203Z","title":"Proceedings of the Forty-first Conference on Uncertainty in Artificial Intelligence , pages =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:32.783203Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:e23378e73de90aeb1d8a68991295502b28eb5ca86a337454cbfee574a8160f32","observation_id":"0e2a1078-3e9d-43af-ada4-def8af1bc4a2","resolution":{"observed_at":"2026-08-01T03:13:32.783203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:32.901654Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:32.901654Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:566f6bafe0fc2000b3ecbd5e17f05f529adab3ca649328457fae942314fb901a","observation_id":"75dead49-a8d9-4e47-9c80-f5b291fcae4b","resolution":{"observed_at":"2026-08-01T03:13:32.901654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:33.026203Z","title":"Algorithmic Learning Theory , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:33.026203Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:b65081e878abbaf7d07f2bcb7560ea6a16fe4cba0edc1aa1164379c495ccfe8c","observation_id":"b5fb795b-c1fc-4212-b58e-37725b8bf53f","resolution":{"observed_at":"2026-08-01T03:13:33.026203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03764","last_updated":"2023-12-05T19:26:01Z","snapshot_observed_at":"2026-08-06T11:12:18.300408Z","submitted_at":"2023-12-05T19:26:01Z","title":"Similarity-based Knowledge Transfer for Cross-Domain Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03764","snapshot_observed_at":"2026-08-01T03:13:33.158389Z","title":"arXiv preprint arXiv:2312.03764 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:33.158389Z"},"links":{"cited_paper":"/paper/2312.03764","citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:5a78008d3db34f074f7b279f7e51e396b652ab432f467d01a8135c33065c368c","observation_id":"4496a6cc-c94b-47b2-8e36-29052d48b866","resolution":{"observed_at":"2026-08-01T03:13:33.158389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:33.287622Z","title":"Conference on robot learning , pages=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:33.287622Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:0ff1e58b101273f167d1c94a2fd2c7a3dd4e2cd274d1964299abcbae2efb047c","observation_id":"33737349-9bfc-46c0-868f-c50787b811dc","resolution":{"observed_at":"2026-08-01T03:13:33.287622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:33.445351Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:33.445351Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:9ad2a026926fac0404363fe9f50378b8d894ffde99f859078787529b77e963bb","observation_id":"bd97b79a-56b3-4637-8afa-73ae21b81a3a","resolution":{"observed_at":"2026-08-01T03:13:33.445351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:33.563631Z","title":"Artificial intelligence and statistics , pages=","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:33.563631Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:7d76c1892220bd2f8471d7c6f358d83140340909f399c0b74afef5d648e164f5","observation_id":"aca1881c-4841-4d51-bf6f-21291ffbf698","resolution":{"observed_at":"2026-08-01T03:13:33.563631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:33.751076Z","title":"Proceedings of Thirty Third Conference on Learning Theory , pages =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:33.751076Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:4afb2d77a9fe6f06fb7b24ac374394d052e7dbbae711e2a17a6b3d61a9527ae0","observation_id":"f1a8620a-4a37-4ca4-83ce-d0ade645e1f9","resolution":{"observed_at":"2026-08-01T03:13:33.751076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:33.877102Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:33.877102Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:172de4e5684cf067aa892c1140bc9ad9a2bf8dc2ce486384936c23d3189f2176","observation_id":"1d542c8d-4983-41d7-aa92-3cc9f512114f","resolution":{"observed_at":"2026-08-01T03:13:33.877102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:34.058131Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:34.058131Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:5638a6c9652acc882c12ad32f453381f54c946378eae3a42c47055ec4c70912b","observation_id":"fa576af6-ea60-4202-8d70-4009dbafe1a4","resolution":{"observed_at":"2026-08-01T03:13:34.058131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:34.196713Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:34.196713Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:396ec1fca1cfda165ac30d78b5d1fda85aa0bd3657b4fd8f67d2717cfa939c86","observation_id":"ed61f22e-fa6a-4268-85d6-196f6e344572","resolution":{"observed_at":"2026-08-01T03:13:34.196713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-01T03:13:34.298145Z","title":"arXiv preprint arXiv:2005.01643 , year=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:34.298145Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:e5f13a92e094fb303ec5d6b79db0d47bce440a3910d4b729979d965f23819e1e","observation_id":"1f65bf4f-6f46-4df8-9d9f-61d421c97ed7","resolution":{"observed_at":"2026-08-01T03:13:34.298145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:34.479905Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:34.479905Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:7b428ff4c4b54fd988460e1b4d64a25adeca745e8d49463c917a9703d756f283","observation_id":"e8f869ba-333f-4ec9-97ba-c3bd4f98a1ce","resolution":{"observed_at":"2026-08-01T03:13:34.479905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:34.657725Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:34.657725Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:5f2a071f45c916b964196a87a394930dcad1097c94da6aede4503e993fd43ed7","observation_id":"1842f728-44b8-4ce0-84d7-35435bcf2adc","resolution":{"observed_at":"2026-08-01T03:13:34.657725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:34.783476Z","title":"Malinga Perera and Renata Borovica","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:34.783476Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:547a9388b1ef0aa9333a150fe226d2ead1096cea43d527bebbe69c70a61f0c71","observation_id":"741afd68-a657-4a93-a65d-f4d8d9ee7cee","resolution":{"observed_at":"2026-08-01T03:13:34.783476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:34.907797Z","title":"NeurIPS , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:34.907797Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:8e0ab7f402f2b0b81d032d35036465a588353262493c085879efbb221aa875ea","observation_id":"f88b56c8-e2fc-4c29-9674-c8fe12be1cb0","resolution":{"observed_at":"2026-08-01T03:13:34.907797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:35.029673Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:35.029673Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:74aad6c547dc85a17f47964a9d563dfc08f1e433c17ecc820ce2185f4a207e83","observation_id":"a2555f4c-e442-4f98-94ec-eac864a18d5c","resolution":{"observed_at":"2026-08-01T03:13:35.029673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:35.225333Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:35.225333Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:2f2ff787cc2dc0c06ce7456549759fe8bd1b79378103b82041ebc8a5fa29b451","observation_id":"6ebd94f5-58fa-4522-bdc9-01228819ed93","resolution":{"observed_at":"2026-08-01T03:13:35.225333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06718","last_updated":"2023-03-11T11:47:54Z","snapshot_observed_at":"2026-08-02T06:10:04.416926Z","submitted_at":"2022-10-13T04:19:05Z","title":"Hybrid RL: Using Both Offline and Online Data Can Make RL Efficient","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.06718","snapshot_observed_at":"2026-08-01T03:13:35.351631Z","title":"arXiv preprint arXiv:2210.06718 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:35.351631Z"},"links":{"cited_paper":"/paper/2210.06718","citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:bfcff6ca4b622a3cbfe00c6ee2bc133ef6f9e5303144691c10977861dbb0a728","observation_id":"3ae795ad-3718-4759-94ea-ce72fd92563d","resolution":{"observed_at":"2026-08-01T03:13:35.351631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:35.470377Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:35.470377Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:945719c4e37e111c67e2d5a8f18c7e42e308b5d629b8516a98ea8afe1bc55f41","observation_id":"7f0ba3b0-4ae4-4e63-88c0-01d598061b55","resolution":{"observed_at":"2026-08-01T03:13:35.470377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:35.616543Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:35.616543Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:3c57f3dcc896072fe665c4f28dbfa95bea23d9ae2cf891ad9b0cb5e612a12739","observation_id":"b108f661-3440-4ba2-8caa-d2ec3739e4d0","resolution":{"observed_at":"2026-08-01T03:13:35.616543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:35.788647Z","title":"SIAM journal on computing , volume=","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:35.788647Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:a93dd95464a6954f773e93e073dc3fe0d36b04866b730843256271d1d6fe0d07","observation_id":"8ffe8f8d-2597-41d2-be89-a2ec1f93606f","resolution":{"observed_at":"2026-08-01T03:13:35.788647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:35.901391Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:35.901391Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:dc82de403006174648332d6d6b87796e5c163bcd0e9fc4b4feba1e68c233ead9","observation_id":"1ddb9295-f505-47ca-866f-3ec6d666c82f","resolution":{"observed_at":"2026-08-01T03:13:35.901391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:36.052455Z","title":"Uncertainty in Artificial Intelligence , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:36.052455Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:90f29d4badeffe6ddaf43bfec3def605bb30fc89389d2b3af4690032bcedd2f4","observation_id":"d6461cf6-b7f2-41b1-95b8-4bda59e17d50","resolution":{"observed_at":"2026-08-01T03:13:36.052455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:36.160441Z","title":"International Joint Conference on Artificial Intelligence , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:36.160441Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:d19f91c64edb93c7fa744a30f1901bc0d9ed3e123d30649109ece6e7549a22ce","observation_id":"0f31d07f-2720-4c7d-b9df-2c444d1ed0f7","resolution":{"observed_at":"2026-08-01T03:13:36.160441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:36.345299Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:36.345299Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:951073500f3c184442acb636af55dc43705ae52c817d6a3e9b57145aec5ecfdb","observation_id":"aa51b38e-b753-402f-b355-16ff40bdb953","resolution":{"observed_at":"2026-08-01T03:13:36.345299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:36.432471Z","title":"Conference on Learning Theory , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:36.432471Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:466e10d7ee153fc632d84746074de8c42475b08d55f51050f3a665bcd6bee978","observation_id":"f429e50f-8236-4170-9c83-734866155581","resolution":{"observed_at":"2026-08-01T03:13:36.432471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:36.527641Z","title":"IEEE Transactions on Emerging Topics in Computational Intelligence , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:36.527641Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:a7d8cdc8ab8c087b6db7a5bce5f05511de594ac79612a39527edc011ba7aaf7c","observation_id":"99b861b6-f621-4587-badf-53666a441e73","resolution":{"observed_at":"2026-08-01T03:13:36.527641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:36.626887Z","title":"Sharp Gap-Dependent Variance-Aware Regret Bounds for Tabular","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:36.626887Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:32b7dadfc98af2ca15de5df0f018b7cd176931dad86668841aa52aea186ef7d9","observation_id":"83c8f1c8-f181-43cd-968a-117a5259e881","resolution":{"observed_at":"2026-08-01T03:13:36.626887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:36.698502Z","title":"The Annals of Statistics , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:36.698502Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:7d201b53e76fa0d8e618405fc5ac3959467fd4747bb3ee481584add6f7f32352","observation_id":"47f8df41-e872-46f7-b635-79d69a11b8a1","resolution":{"observed_at":"2026-08-01T03:13:36.698502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:36.755046Z","title":"Policy Finetuning: Bridging Sample-Efficient Offline and Online Reinforcement Learning , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:36.755046Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:67f0cb3388cdcf74ab66c89e60ff567fa5cc1f991e5ea24fc1171fd2fd66a9a6","observation_id":"b619e6a8-cc1c-4925-bee4-a8ab21f0d437","resolution":{"observed_at":"2026-08-01T03:13:36.755046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:36.827229Z","title":"Minimax Regret Bounds for Reinforcement Learning , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:36.827229Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:1ddeb362f181ce8c7a5d676c6c4bbdef2ccc55d0fff7f57e65eb8656e5fede95","observation_id":"5a1350fc-caa7-4d5e-b076-033d41f81aff","resolution":{"observed_at":"2026-08-01T03:13:36.827229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T03:13:36.890833Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T03:13:36.890833Z"},"links":{"citing_paper":"/paper/2607.25207"},"observation_digest":"sha256:81e31b81689bb61fc173081d1494bf0fa556bcb31a9924b77b830daa6e521d4f","observation_id":"0de41ea1-3067-423a-8f61-90eee55fc56a","resolution":{"observed_at":"2026-08-01T03:13:36.890833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25207","last_updated":"2026-07-28T02:27:27Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T15:41:36.505681Z","submitted_at":"2026-07-28T02:27:27Z","title":"A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2607.25207."}