{"as_of":"2026-08-15T22:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:71ba894f78704a9735b47e8d1245c29d97ebfbd104158aa80b66b79f4ecce550","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:32:09.371004Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.02639/citation-record","integrity":"/paper/2507.02639/integrity","json":"/paper/2507.02639/citation-record.json","paper":"/paper/2507.02639"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:10.382388Z","title":"Then, the function to predict the next state,fs :H→S or fs :H×A→S , can be assigned any GP prior (e.g., SVGP)","venue":null,"work_id":"b17c7755-9757-4a4f-900c-a7c90dafdcc9","year":2021},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:09.072509Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:1e62f2162cd61f9d8b72e59302dbc1a40f61b6661a8fd1dacc70b902d9d0b6ae","observation_id":"3769e907-d752-4057-a7e3-992114634450","resolution":{"observed_at":"2026-08-06T20:32:10.444233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-15T12:04:28.662048Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-06T20:32:07.896578Z","title":"Continuous control with deep reinforcement learning.arXiv preprint arXiv:1509.02971,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:07.896578Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:8a5b4e6eec212ee1a485a1d10aef5a2274a0fa81634ca2fc36f867714720acd8","observation_id":"ea5136d9-a939-444f-8742-9480df7738bb","resolution":{"observed_at":"2026-08-06T20:32:07.896578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:09.985712Z","title":"Description of each model is enclosed in the figure’s caption","venue":null,"work_id":"8e7892f3-57c3-4594-b9fd-6b99ddda78e5","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:09.194512Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:2f930298d23a1ce8c11f93887ced1d180b4a00d9e66da385873b8ebf4b701bf4","observation_id":"8c73c0fb-4e37-4650-b5c7-1e43789cb9a0","resolution":{"observed_at":"2026-08-06T20:32:10.064260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:09.778031Z","title":"temperature","venue":null,"work_id":"f3f49a0c-7e79-43b1-8185-c87b335fbfcf","year":2017},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:09.251812Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:7205286e4b3232244c64a74627fcab9be9a0726bb743b3ce3c35316dd9667757","observation_id":"7a4a3c3c-77da-408b-8e07-ba65e2c054b7","resolution":{"observed_at":"2026-08-06T20:32:09.885251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:12.322498Z","title":"As for what requirements are needed for posterior consistency, we need intuitively that priorπ(θ) do not excludeθ0 from its support","venue":null,"work_id":"8ab60086-2191-473a-b20a-82dd31c107fa","year":1965},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.537178Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:f2a1281c665f66b57b41629b1bc12560bb61ff44b048127492640657a7d5e2e4","observation_id":"a4f55b76-6244-42b8-91f5-600c23ab8395","resolution":{"observed_at":"2026-08-06T20:32:12.421059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:12.074766Z","title":"This is formalized as follows (Schwartz, 1965; Ghosal & Van der Vaart, 2017)","venue":null,"work_id":"aded31d9-592e-4e5d-9cc9-0d24df718320","year":1965},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.595056Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:ab4e88bd6bef8e6fad88c4fb26e3e2ee91197523140447a96e7ff67f6ddce3e4","observation_id":"fcd90b0e-73c5-47e5-b5d2-a9626ac9857c","resolution":{"observed_at":"2026-08-06T20:32:12.172735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:11.828236Z","title":null,"venue":null,"work_id":"9f4e94a1-5ada-44a8-8c86-e2e246ef0ca5","year":2008},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.670731Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:0ca0f21d9c17a6b86c69a9f97ed6e3dd7a6b6e81de04486b364fd2448b0e801d","observation_id":"11ed430a-7e41-4a25-b3a7-517a3f9d46bd","resolution":{"observed_at":"2026-08-06T20:32:11.934696Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:11.578796Z","title":"Notice that with(logn)t = 1, the above is equal to the minimax rate (best rate of estimation) for functions in the classCα(X ) (Yang & Barron, 1999)","venue":null,"work_id":"bcc88caf-db60-4671-99df-ef783cb0e0c0","year":2011},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.733204Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:e2500d8498de9ca833009b59fbba4c13799dd2da7d48501033ec136ef798faaa","observation_id":"a7b0dae8-ebe4-4c64-b46f-9566fbb021ce","resolution":{"observed_at":"2026-08-06T20:32:11.721602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:11.284315Z","title":"DefineHα(X ) as the Sobolev space, then: Theorem A.9(Van Der Vaart & Van Zanten (2011))","venue":null,"work_id":"d32c91ca-87ef-408e-8290-f3c4a9f4829b","year":2011},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.790574Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:d8d33e6c805fab62b95750bd3f88c89d2fecd7d5e2c05aeddcd698e36a025ba1","observation_id":"6d0b4549-c527-4a97-9064-eb00c3ed9a7d","resolution":{"observed_at":"2026-08-06T20:32:11.450220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:10.876173Z","title":null,"venue":null,"work_id":"57c0b4c5-6155-426b-96b7-c101af37a883","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.935023Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:db51c9be60355bd1a60f689214ccb3b78095b5f1cc108a0939516bd8e376067c","observation_id":"7e2bf8d2-0325-4f62-8837-39c181afd654","resolution":{"observed_at":"2026-08-06T20:32:10.996044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:10.541302Z","title":null,"venue":null,"work_id":"9eaca7d3-eb44-418a-bb2b-1dc5691e389c","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:09.021599Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:0ebeac8f1869d66b7aced37b055b7f5e470a1caf59264b805a920db8abaf4b71","observation_id":"6180afa5-335d-4e38-869d-5825620136b5","resolution":{"observed_at":"2026-08-06T20:32:10.613039Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:09.586077Z","title":null,"venue":null,"work_id":"90159116-dc2f-4313-ba7c-55352772591e","year":2015},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:09.320546Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:e798cf52938deba880aa3c40bdffd419c6c3f582ec8ddfcf0a2e5463823e9492","observation_id":"379dbd98-baef-4992-9149-6f4343c66bcf","resolution":{"observed_at":"2026-08-06T20:32:09.665133Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:09.479532Z","title":null,"venue":null,"work_id":"07aed0f2-ab51-43de-bf87-0845f9f93edf","year":2019},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:09.371004Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:40eb86765c1d1140b7f6362f85e48d7683e83366a0b6309737b6ec36867037a6","observation_id":"df300faf-7bd5-41f3-9950-8c148a7c2875","resolution":{"observed_at":"2026-08-06T20:32:09.532386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:10.693017Z","title":"be incorporated a priori","venue":null,"work_id":"a1218aed-d8c8-465c-9b23-0e3cd1f88db8","year":2013},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.979761Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:85f5cb2323e4818e1635cea96e5d4735d1fece9225457f4c9a53d9a9d163fd68","observation_id":"b76c4086-3195-4ae8-aefb-fc24a148e3a5","resolution":{"observed_at":"2026-08-06T20:32:10.768612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:11.086411Z","title":"As stated in main paper, the issue associated with computing IGθ(st,at,st+1) is that it can be done only in a reactive setting wherest+1 is actually revealed to the agent","venue":null,"work_id":"2b7f4dec-c0c9-4f76-bf3d-6bb97904dd4d","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":1948,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.870970Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:5f9f5210e3433eb13437f1f5c486e78dad3010586a6e1bfe1373386bac747392","observation_id":"83592411-d56e-44e5-8ea4-3e6113700be5","resolution":{"observed_at":"2026-08-06T20:32:11.161549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:13.102253Z","title":"Planning to explore via self-supervised world models","venue":null,"work_id":"31c249a7-f5e6-43c8-968b-3307a082cf7f","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":1965,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.217101Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:7f8d49c068f281b2c8c2620951bc991ebf0ed62a07bc518bcf52ec4aedc8ff3d","observation_id":"09935f56-6ca8-460c-ab7f-1f0d035780f6","resolution":{"observed_at":"2026-08-06T20:32:13.233946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T20:32:08.098707Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.098707Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:c95b85c45db05b08e0e143e60514b5952c34ec4eccda1b1fafc5297c6a12d776","observation_id":"4f15c855-243a-4823-9bee-d2dc0a859558","resolution":{"observed_at":"2026-08-06T20:32:08.098707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:12.534022Z","title":null,"venue":null,"work_id":"c235cd01-ed80-40aa-a3ae-f2ac61244909","year":2017},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":1999,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.502993Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:0b576ec5861454e81a0107a4d075aeb6a94f0b1b50805a6114bfcf63b1e0695c","observation_id":"78eaa033-1f4a-461e-be1b-d4d2cbff72d7","resolution":{"observed_at":"2026-08-06T20:32:12.633848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:12.960843Z","title":"A bayesian framework for reinforcement learning","venue":null,"work_id":"1fe45f18-2b4e-4abd-8249-d87dad811721","year":2000},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.336517Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:66a962d89185cf45a110f2bf255a86b1e1aafe2b3bb335f1dda9a12c4ceab298","observation_id":"a715209b-8199-485b-95b5-e021210a55a4","resolution":{"observed_at":"2026-08-06T20:32:13.054614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.11409","last_updated":"2022-03-07T12:54:27Z","snapshot_observed_at":"2026-08-10T01:16:00.200780Z","submitted_at":"2021-02-22T23:29:12Z","title":"On Feature Collapse and Deep Kernel Learning for Single Forward Pass Uncertainty","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.11409","snapshot_observed_at":"2026-08-06T20:32:08.390877Z","title":"On feature collapse and deep kernel learning for single forward pass uncertainty.arXiv preprint arXiv:2102.11409,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.390877Z"},"links":{"cited_paper":"/paper/2102.11409","citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:15d8082f8a66a55a8dc092c5190fbcf0a9c0eb0e7acee006ec3c5ba94160cccb","observation_id":"3cf3bb99-05af-4547-8fd3-c1533e203c01","resolution":{"observed_at":"2026-08-06T20:32:08.390877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1507.00814","last_updated":"2015-11-19T22:40:30Z","snapshot_observed_at":"2026-08-14T22:41:54.228211Z","submitted_at":"2015-07-03T04:11:15Z","title":"Incentivizing Exploration In Reinforcement Learning With Deep Predictive Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1507.00814","snapshot_observed_at":"2026-08-06T20:32:08.296177Z","title":"Incentivizing exploration in reinforcement learning with deep predictive models.arXiv preprint arXiv:1507.00814,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.296177Z"},"links":{"cited_paper":"/paper/1507.00814","citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:8a0d4c773a239ef0aee178beab45c901ae059024247942860bbe613ba67f4d59","observation_id":"d71a2f10-b44e-43c8-9554-db93a73f34ed","resolution":{"observed_at":"2026-08-06T20:32:08.296177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1112.5745","last_updated":"2011-12-24T17:53:19Z","snapshot_observed_at":"2026-08-15T04:24:32.276881Z","submitted_at":"2011-12-24T17:53:19Z","title":"Bayesian Active Learning for Classification and Preference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1112.5745","snapshot_observed_at":"2026-08-06T20:32:07.827204Z","title":"Bayesian active learning for classification and preference learning.arXiv preprint arXiv:1112.5745,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:07.827204Z"},"links":{"cited_paper":"/paper/1112.5745","citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:e47b528358ccc79e7fccbfedaddf95424b9f1748e088f228f0b0c16e93e0d45b","observation_id":"3b4e5787-5471-46f2-a869-b61ab6c8bfe9","resolution":{"observed_at":"2026-08-06T20:32:07.827204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:13.296592Z","title":"A unifying view of sparse approximate gaussian process regression","venue":null,"work_id":"9975d14c-1b35-417b-a02c-e25279e7c4f2","year":1939},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.011834Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:2e41bf03cd3fc7823bb9f7c732ae844bbb06d9401edbfb4859a09f10167d2440","observation_id":"c18ec8ce-613f-45ee-b7af-06ee22a14b17","resolution":{"observed_at":"2026-08-06T20:32:13.412169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:13.478413Z","title":"On a measure of the information provided by an experiment.The Annals of Mathematical Statistics, 27(4):986–1005,","venue":null,"work_id":"41d1f817-b483-4c1e-b3d8-5c3946698b31","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:07.946615Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:deb4b5e57489eefc0dec78a6cf448d87a4f27e4a0bb70dcf3e23b7335944468c","observation_id":"a504bef3-d124-4b8c-a59a-df4f7fcb9888","resolution":{"observed_at":"2026-08-06T20:32:13.625468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:10.193239Z","title":null,"venue":null,"work_id":"f7b52e1c-df01-4376-97da-289ab5ce086a","year":2021},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:09.148780Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:06231949dbfe14d10908630aebb723d51fb66907f577fcc46fffc2a6a762ddb5","observation_id":"bdc0d988-8886-4eea-aff3-36cb20fc6265","resolution":{"observed_at":"2026-08-06T20:32:10.306965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:13.791739Z","title":"Posterior consistency of dirichlet mixtures in density estimation","venue":null,"work_id":"7cb414dc-e85e-4588-b953-a423942e7bb9","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:07.725405Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:f9fbfdf4f496b4b0a8d25b55a0f7025e7aef7f7a5d55c6568981629cf98cd52b","observation_id":"975aee35-52d6-464a-b8b6-5b95c548c023","resolution":{"observed_at":"2026-08-06T20:32:13.938358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:14.105449Z","title":"Intrinsic motivation and reinforcement learning.Intrinsically motivated learning in natural and artificial systems, pp","venue":null,"work_id":"ef6fb5ab-bfa8-471d-9352-a9e358388a53","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:07.619784Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:17c1beed6b094265ac91ad9728623e36ac1d558df30a85c5a47e67e59650a0ae","observation_id":"55cce8e3-083b-4e2e-a4c2-9853649e1701","resolution":{"observed_at":"2026-08-06T20:32:14.225076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:32:12.757613Z","title":"Stochastic variational deep kernel learning","venue":null,"work_id":"f990dc1f-7ded-4647-be93-ec57705b8252","year":2025},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:08.438262Z"},"links":{"citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:defccd1bf8eb1ff1cb055760bf9f2ac549689e3dc9a869e317cb21e9838cf419","observation_id":"5bce1c38-d3dc-4f60-aa41-9136ac3bab57","resolution":{"observed_at":"2026-08-06T20:32:12.825369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-08-15T21:57:33.408765Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-06T20:32:07.655869Z","title":"D4rl: Datasets for deep data-driven reinforcement learning","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T20:32:07.655869Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2507.02639"},"observation_digest":"sha256:4658328a5d74047a8dcb42b82aa8b71ee9b9e11768ffa1cc3e37e826dbde0587","observation_id":"41516c33-e533-4df7-804d-da608299af87","resolution":{"observed_at":"2026-08-06T20:32:07.655869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.02639","last_updated":"2025-07-03T14:03:47Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T20:53:26.181721Z","submitted_at":"2025-07-03T14:03:47Z","title":"On Efficient Bayesian Exploration in Model-Based Reinforcement Learning"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2507.02639."}