{"as_of":"2026-08-20T16:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3b59fe7aa6fc162e6a192cdf434323c987bac262f27df6bb963244aabec95800","coverage":[{"denominator":300,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:17:40.128832Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.07911/citation-record","integrity":"/paper/2505.07911/integrity","json":"/paper/2505.07911/citation-record.json","paper":"/paper/2505.07911"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.509707Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.509707Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:ce3f4949214fa039d83ab60806e05b6413412b15db5da7ca6f58e704931f00c0","observation_id":"82d35e24-a6a2-4eae-82cb-fdab4f30de34","resolution":{"observed_at":"2026-08-15T22:17:38.509707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.526070Z","title":"Attention in Psychology , Neuroscience , and Machine Learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.526070Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:27c013c86b01bf04acb499c0c38ddf91fea06bbd34c8c90c228560241ed3f100","observation_id":"4500423d-1e0b-47e2-a99d-2111ae1375a1","resolution":{"observed_at":"2026-08-15T22:17:38.526070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-15T22:17:38.541203Z","title":"DeepSeek -V3 Technical Report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.541203Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:e22ee0d49b58d7d174d9e3071b383ab4d412ea5470022ed5674ce025665a2de2","observation_id":"367cc9cf-f0ba-468b-af0a-6f22cc57447e","resolution":{"observed_at":"2026-08-15T22:17:38.541203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.569212Z","title":"Mathematical Capabilities of ChatGPT,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.569212Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:c632c447aaed9e6a76b64267f1e42caa63d02e643144171a4b78f90508516bc2","observation_id":"1a97c8e8-7ea2-4adf-a6df-3ba803440eb6","resolution":{"observed_at":"2026-08-15T22:17:38.569212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.594266Z","title":"Modulationof neuronal activity by target uncertainty,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.594266Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:7dd7e5ce18495994d700c0f51fd5ea90a6d6ccc64ec40a30be4ead3acb7e5c34","observation_id":"a3f8ccf6-b29d-452b-8882-217dfb545653","resolution":{"observed_at":"2026-08-15T22:17:38.594266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.601538Z","title":"Neural implementations of Bayesian inference,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.601538Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:b03ec31fc59ab8d74b63e60478abb0231103a27fcd30551846b0b722e4a2e964","observation_id":"2024ee56-c590-475b-80c9-1e54e97dec35","resolution":{"observed_at":"2026-08-15T22:17:38.601538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.615497Z","title":"Neural substrate of dynamic Bayesian inference in the cerebral cortex,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.615497Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:96c0a5e5ac73bb62bbe154f3a62d72e8ea2260c0af99e0831999d3697c369073","observation_id":"6284b67d-241c-4bc8-907f-8742e9ba2f6f","resolution":{"observed_at":"2026-08-15T22:17:38.615497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.628874Z","title":"Neural implementation of Bayesian inference in a sensorimotor behavior,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.628874Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:b07ec0513a95bbb6c4a4914f65096747696646102c08ac8fb28fb952e40210dc","observation_id":"7e9f7bac-d8cb-4a5d-a4ae-13bf3e425a04","resolution":{"observed_at":"2026-08-15T22:17:38.628874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.640197Z","title":"Bayesian Computation through Cortical Latent Dynamics,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.640197Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:c00d4a03dda7f0ce7eaee1e5de362ab6ca38c7aa06d68b233953bb05339b9837","observation_id":"8a0ae773-7625-4281-8d9b-44ebf5973ff5","resolution":{"observed_at":"2026-08-15T22:17:38.640197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.649366Z","title":"Neural Correlates of Optimal Multisensory Decision Making under Time -Varying Reliabilities with an Invariant Linear Probabilistic Population Code,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.649366Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:24c49b63a69ea27194403ef50dfdde52d99ebb0da059e217168fee4ad40f642e","observation_id":"f4078d91-29dd-4fdc-ab58-5175d3dde52d","resolution":{"observed_at":"2026-08-15T22:17:38.649366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.672173Z","title":"A neural basis of probabilistic computation in visual cortex,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.672173Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:39a6b3da517e324d09afa5667d08e2990f1e71155e1c320ea1c0269e0099b475","observation_id":"29cd919b-4bec-4220-909b-5dac3a345350","resolution":{"observed_at":"2026-08-15T22:17:38.672173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.689715Z","title":"Reinforcement learning and its connections with neuroscience and psychology,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.689715Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:b0d1632334a2211aeea5e07f4124cca801ce76f4f87748d4b6ef9f7cd07cb3f1","observation_id":"000ea44b-1641-4c72-82c2-83a340842ec8","resolution":{"observed_at":"2026-08-15T22:17:38.689715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.03559","last_updated":"2019-05-20T12:39:51Z","snapshot_observed_at":"2026-08-14T17:32:15.651077Z","submitted_at":"2019-01-11T11:42:51Z","title":"An investigation of model-free planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.03559","snapshot_observed_at":"2026-08-15T22:17:38.705031Z","title":"An Investigation of Model -Free Planning,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.705031Z"},"links":{"cited_paper":"/paper/1901.03559","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:0a70454cdeb020982b9f712269dd68cbb439d3a1ce15b1c8c42f12187264c9ed","observation_id":"a07c7bc7-2db9-4b00-a2a4-dcf013abbb2a","resolution":{"observed_at":"2026-08-15T22:17:38.705031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.713302Z","title":"Meta - learning, social cognition and consciousness in brains and machines,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.713302Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:d21576f351ebe818a97ec83117cc9a302b7cc23aead2badd4c7b451c8ca2e0b6","observation_id":"56611f1e-82ec-4edd-900e-01f521a1fab7","resolution":{"observed_at":"2026-08-15T22:17:38.713302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.03750","last_updated":"2020-07-07T19:27:54Z","snapshot_observed_at":"2026-08-14T14:11:55.349781Z","submitted_at":"2020-07-07T19:27:54Z","title":"Deep Reinforcement Learning and its Neuroscientific Implications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.03750","snapshot_observed_at":"2026-08-15T22:17:38.732406Z","title":"Deep Reinforcement Learning and its Neuroscientific Implications,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.732406Z"},"links":{"cited_paper":"/paper/2007.03750","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:61af5134a142c5c6771d61f339892c631b343ff411af5941fe6b8c9febd06657","observation_id":"5f5c5eef-3b6e-4f3d-8176-937db6692343","resolution":{"observed_at":"2026-08-15T22:17:38.732406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.742059Z","title":"Model -based and Model -free RL for Robot Control,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.742059Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:04473df14342490eee7dd2f9e5febecb950506596cfdb7c3e07db34a9d76e354","observation_id":"7a9b029c-c258-4772-9a06-85d5059a3fe0","resolution":{"observed_at":"2026-08-15T22:17:38.742059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.00909","last_updated":"2018-05-20T20:03:59Z","snapshot_observed_at":"2026-08-08T20:31:18.897748Z","submitted_at":"2018-05-02T17:11:20Z","title":"Reinforcement Learning and Control as Probabilistic Inference: Tutorial and Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.00909","snapshot_observed_at":"2026-08-15T22:17:38.775117Z","title":"Reinforcement Learning and Control as Probabilistic Inference : Tutorial and Review,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.775117Z"},"links":{"cited_paper":"/paper/1805.00909","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:0a8690c0465b009ec0ee33054ce5bea62e4ed59c55e2241dc9f21dc81e56e0a7","observation_id":"5b1e9b74-4a54-40e9-b56e-a400c0efc63d","resolution":{"observed_at":"2026-08-15T22:17:38.775117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.09647","last_updated":"2022-12-06T17:15:19Z","snapshot_observed_at":"2026-08-14T18:47:52.230363Z","submitted_at":"2018-07-25T14:56:09Z","title":"Variational Bayesian Reinforcement Learning with Regret Bounds","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.09647","snapshot_observed_at":"2026-08-15T22:17:38.788821Z","title":"Variational Bayesian Reinforcement Learning with Regret Bounds,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.788821Z"},"links":{"cited_paper":"/paper/1807.09647","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:00d5a34a721ddfa250956491ef90bf39b875cec504529d62938183c5f88145c8","observation_id":"50aeb199-af5f-43c7-a15a-b600475ea4ff","resolution":{"observed_at":"2026-08-15T22:17:38.788821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.799826Z","title":"Interpretable End -to- End Urban Autonomous Driving With Latent Deep Reinforcement Learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.799826Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:b62ff640d7b31eba9b39d99c937002befb16529ec76bfcae00113aada5b1e602","observation_id":"1133f02c-db00-48e1-acc2-68f5feb9f238","resolution":{"observed_at":"2026-08-15T22:17:38.799826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.817552Z","title":"Interpretable Decision -Making for Autonomous Vehicles at Highway On -Ramps With Latent Space Reinforcement Learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.817552Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:b630fc92b76343f2b218f0bcadfa50361b0cffff626536136a256101f62d7466","observation_id":"7927b2da-f91a-44d5-924f-d2a563aaa1a6","resolution":{"observed_at":"2026-08-15T22:17:38.817552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.831204Z","title":"Making Sense of Reinforcement Learning and Probabilistic Inference,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.831204Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:9341ad852a462f96503fcfd75922cfa54b8e6423303292658c5b0bb2b2b2dc93","observation_id":"0de58784-6ddf-48b7-9536-286a405f8e3e","resolution":{"observed_at":"2026-08-15T22:17:38.831204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04436","last_updated":"2016-09-14T20:34:26Z","snapshot_observed_at":"2026-08-20T08:56:23.886656Z","submitted_at":"2016-09-14T20:34:26Z","title":"Bayesian Reinforcement Learning: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.04436","snapshot_observed_at":"2026-08-15T22:17:38.847265Z","title":"Bayesian Reinforcement Learning : A Survey,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.847265Z"},"links":{"cited_paper":"/paper/1609.04436","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:745ed32ca3f0295a401a7b60abbd38f91b06e607b1a664d49d44a4acc1f84689","observation_id":"7177e1e3-0935-4d9e-9aa5-bbe1ff8b1e59","resolution":{"observed_at":"2026-08-15T22:17:38.847265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.871071Z","title":"State estimation for robotics,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.871071Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:a8b5fc40443e81f939e85ed5bd531c500bf42f4f98c0330f2ece1b13f2564836","observation_id":"ba75702c-7d1b-4e6a-8844-b8da9e220b44","resolution":{"observed_at":"2026-08-15T22:17:38.871071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.889279Z","title":"Variational Inference: A Review for Statisticians,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.889279Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:35b7bae61ae04aad34610218075b3085bd7e7406e07092fb8af99411797c4d51","observation_id":"757906a7-2043-48f9-85e5-190b3da3d907","resolution":{"observed_at":"2026-08-15T22:17:38.889279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.899990Z","title":"Taking the Human Out of the Loop: A Review of Bayesian Optimization,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.899990Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:73d7432e450bee394c957a09b5e1348405fe839e33333ce55df4013a633b6070","observation_id":"d4c993fe-24f1-44f9-80ee-0066518cf211","resolution":{"observed_at":"2026-08-15T22:17:38.899990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.12024","last_updated":"2026-04-18T05:11:40Z","snapshot_observed_at":"2026-08-02T14:54:34.962646Z","submitted_at":"2020-06-22T06:30:15Z","title":"Bayesian Neural Networks: An Introduction and Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.12024","snapshot_observed_at":"2026-08-15T22:17:38.909395Z","title":"Bayesian Neural Networks: An Introduction and Survey,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.909395Z"},"links":{"cited_paper":"/paper/2006.12024","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:31e1b29d79c0156ff8a88e2826d32131ba83b9783025e573a473d0d112ef3e46","observation_id":"2d38b192-5b0d-42b5-bbce-dfec286f07da","resolution":{"observed_at":"2026-08-15T22:17:38.909395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.00236","last_updated":"2021-12-05T22:20:32Z","snapshot_observed_at":"2026-08-14T10:50:52.452096Z","submitted_at":"2020-08-30T04:28:31Z","title":"A Survey of Deep Active Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.00236","snapshot_observed_at":"2026-08-15T22:17:38.915977Z","title":"A Survey of Deep Active Learning,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.915977Z"},"links":{"cited_paper":"/paper/2009.00236","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:3d9bd781b45a76e79375be5e26e4e4a5d3db92c24d1ce95f6d7629a8737d5c5f","observation_id":"ff43585f-c64b-4cea-9a51-fa38211608b4","resolution":{"observed_at":"2026-08-15T22:17:38.915977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.923953Z","title":"Model -based Multi -agent Reinforcement Learning: Recent Progress and Prospects,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.923953Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:73848ede2f46fd95cea8a938db4f91ed2d3af69bb015429e4f9b0cb0e6914fe2","observation_id":"3462ca85-7088-43fe-abe7-b9aa4a36ef82","resolution":{"observed_at":"2026-08-15T22:17:38.923953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.935177Z","title":"A Survey of Multi -Task Deep Reinforcement Learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.935177Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:39ee8fe425f18015eb82419c3cc53c7682a0ecaba62f20a0df5a9ebb34d30b49","observation_id":"335d055a-aba3-45ec-b310-4a30afb6398d","resolution":{"observed_at":"2026-08-15T22:17:38.935177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-18T14:02:27.816186Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-15T22:17:38.946121Z","title":"A Survey of Meta -Reinforcement Learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.946121Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:30cebba8d854a449bf10024e48dc2fbe69862ebd85e58162961c57dceb1888b9","observation_id":"682d6bb0-a33b-4e7c-b4fe-a1e51e5059ce","resolution":{"observed_at":"2026-08-15T22:17:38.946121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11047","last_updated":"2023-03-20T11:58:40Z","snapshot_observed_at":"2026-08-19T22:45:18.209544Z","submitted_at":"2023-03-20T11:58:40Z","title":"Practical Realization of Bessel's Correction for a Bias-Free Estimation of the Auto-Covariance and the Cross-Covariance Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11047","snapshot_observed_at":"2026-08-15T22:17:38.956286Z","title":"Practical Realization of Bessel’s Correction for a Bias - Free Estimation of the Auto -Covariance and the Cross -Covariance Functions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.956286Z"},"links":{"cited_paper":"/paper/2303.11047","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:b19f064edc7226bf82c048765211ca2ede158de8dee90ae3dc7db44bced744b4","observation_id":"45c96566-9e2f-4e56-a0dc-6b12cd3ceeef","resolution":{"observed_at":"2026-08-15T22:17:38.956286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:38.982085Z","title":"Bayes’ Theorem,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:38.982085Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:6480f398b08044e4a33ff1eb7f89f4df458e48976b74ee527e0f49feeed61446","observation_id":"e61e5053-40a4-4664-a2f0-d19e577d3353","resolution":{"observed_at":"2026-08-15T22:17:38.982085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.000615Z","title":"Predicting human navigation goals based on Bayesian inference and activity regions,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.000615Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:0e786b444a6f0b8702fe4cf2e54ab670ceda82bc8917cbaf4ba5f850ee067e4f","observation_id":"e8d6514e-5f5f-47cc-ba0a-c1e96cb597cc","resolution":{"observed_at":"2026-08-15T22:17:39.000615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.013641Z","title":"Adaptive Bayesian inference system for recognition of walking activities and prediction of gait events using wearable sensors,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.013641Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:54f9465959d6c64a56f86c9c013b6fe45004d800189df858b54be070131ed03d","observation_id":"301580a0-3fa5-4401-9e9f-d1df199ad148","resolution":{"observed_at":"2026-08-15T22:17:39.013641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.026576Z","title":"Safety Assurances for Human -Robot Interaction via Confidence -aware Game-theoretic Human Models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.026576Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:724d0cea5d6de8e63d87b8af8e7b69cb73a58420c8f02517a3fe1ad9daf77e8b","observation_id":"d8bc8a41-92a6-45b6-951b-89d0bfdccde0","resolution":{"observed_at":"2026-08-15T22:17:39.026576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.040117Z","title":"Bayesian generalized kernel inference for occupancy map prediction Bayesian Generalized Kernel Inference for Occupancy Map Prediction,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.040117Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:dd3677657e36b0722b689635d3735851abbfe2ee92d5f44cb33dab725be5b97f","observation_id":"ca3e8c3d-a212-4e69-85e5-e3b9ff22c50f","resolution":{"observed_at":"2026-08-15T22:17:39.040117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.053589Z","title":"Gaussian Processes for Machine Learning,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.053589Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:8dcf1c902cf80376ee971f7eba71df1abf44e08c278d91e8284811d51260af6a","observation_id":"2cded33d-691b-47da-b7ea-6ef2960428b6","resolution":{"observed_at":"2026-08-15T22:17:39.053589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.065681Z","title":"The pitfalls of using Gaussian Process Regression for normative modeling,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.065681Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:64fb55633cf322c0f8fb7de43d95148e3874790b79b74238dda3c0c9a324327e","observation_id":"1e90e51a-4e06-4cf1-8b90-98e787a3cddd","resolution":{"observed_at":"2026-08-15T22:17:39.065681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03117","last_updated":"2022-09-07T13:08:22Z","snapshot_observed_at":"2026-08-16T16:34:11.082575Z","submitted_at":"2022-09-07T13:08:22Z","title":"Non-Gaussian Process Regression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03117","snapshot_observed_at":"2026-08-15T22:17:39.075398Z","title":"Non -Gaussian Process Regression,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.075398Z"},"links":{"cited_paper":"/paper/2209.03117","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:2a8df01bb1a8971eb22af501d9447cf91e0c8f8e327e9e22792a51ce4d8b6629","observation_id":"0f497521-2457-4f6a-9c29-29a3789c5c42","resolution":{"observed_at":"2026-08-15T22:17:39.075398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.083868Z","title":"Bayesian nonparametric kernel -learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.083868Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:2dccdc51f88967a6da0182129602e17b3c5abfa23900641992926c1fb80aa89c","observation_id":"7ac2aa8d-cd07-4ab8-aec2-153aeb045a3a","resolution":{"observed_at":"2026-08-15T22:17:39.083868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.091146Z","title":"Artificial intelligence: A Modern Approach (Third Edition),","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.091146Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:f4188676219e67e4760a8c9f73108f227ef533408525fbe7e5c59ced25d78a5f","observation_id":"9097bee9-81db-4ef6-b2ce-14587ceb2537","resolution":{"observed_at":"2026-08-15T22:17:39.091146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.103201Z","title":"Gaussian process dynamical models for human motion,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.103201Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:4b65862a839cf1b28c585a1b13024c5c64fa6871b2167323a1b76644b252238a","observation_id":"2eab32af-9dba-4ef3-a833-e1776dc8114d","resolution":{"observed_at":"2026-08-15T22:17:39.103201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.08912","last_updated":"2018-10-31T01:32:42Z","snapshot_observed_at":"2026-08-14T18:48:32.014738Z","submitted_at":"2018-07-24T05:46:04Z","title":"Meta-Learning Priors for Efficient Online Bayesian Regression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.08912","snapshot_observed_at":"2026-08-15T22:17:39.113310Z","title":"Meta -Learning Priors for Efficient Online Bayesian Regression,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.113310Z"},"links":{"cited_paper":"/paper/1807.08912","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:1a971a8a77a2f2830c217d6f540cb3ba134dcb9eecd382606fea1ea1a41421c3","observation_id":"fb8a9f05-b820-4494-93c5-2766f1ad3cfb","resolution":{"observed_at":"2026-08-15T22:17:39.113310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.00048","last_updated":"2017-09-25T11:04:46Z","snapshot_observed_at":"2026-08-14T21:03:57.668649Z","submitted_at":"2017-04-28T19:34:41Z","title":"On the sub-Gaussianity of the Beta and Dirichlet distributions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.00048","snapshot_observed_at":"2026-08-15T22:17:39.147519Z","title":"On the sub -Gaussianity of the Beta and Dirichlet distributions,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.147519Z"},"links":{"cited_paper":"/paper/1705.00048","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:eb708ef7ddf5216e09016063b92f93fb0cdff7617f2ebb2e82b1f885906cb2bd","observation_id":"24be9cf6-6ce5-4adb-b7c8-6eb4c809b1e6","resolution":{"observed_at":"2026-08-15T22:17:39.147519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.191821Z","title":"Bayesian approaches to Gaussian mixture modeling,","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.191821Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:f13a63195d083f0031b41e0020a4d7eb4d1c3c4591103405ab920e3d907fed1a","observation_id":"8ebbb586-2a3e-4ea7-9d2a-927c4935904f","resolution":{"observed_at":"2026-08-15T22:17:39.191821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.209899Z","title":"Hierarchical Gaussian Mixture Model,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.209899Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:278c6b4800b97d938166db9e91b31e7d4b0a1c9179a3b6805f8783c1d843e2eb","observation_id":"33e2343a-39e4-4d8d-87b2-a3f71e8902a6","resolution":{"observed_at":"2026-08-15T22:17:39.209899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.216429Z","title":"Hierarchical Clustering of a Mixture Model,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.216429Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:b97abfae455218bf24d10c5d42c90ff4b51666b2e472606756c7a965449744b3","observation_id":"8fbfe7e9-4b86-44c3-840c-491e4d18a963","resolution":{"observed_at":"2026-08-15T22:17:39.216429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1603.08342","last_updated":"2016-03-28T08:54:03Z","snapshot_observed_at":"2026-08-14T22:04:16.149532Z","submitted_at":"2016-03-28T08:54:03Z","title":"Hierarchical Gaussian Mixture Model with Objects Attached to Terminal and Non-terminal Dendrogram Nodes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1603.08342","snapshot_observed_at":"2026-08-15T22:17:39.221792Z","title":"Hierarchical Gaussian Mixture Model with Objects Attached to Terminal and Non -terminal Dendrogram Nodes,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.221792Z"},"links":{"cited_paper":"/paper/1603.08342","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:10ad3f05fe196be497816f596c88cb665fa0b655cce1b0236f98bae1899b976e","observation_id":"51787c60-edab-4795-95f3-5ca583cf16dd","resolution":{"observed_at":"2026-08-15T22:17:39.221792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.227196Z","title":"HGMR : Hierarchical Gaussian Mixtures for Adaptive 3D Registration,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.227196Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:45034c11a700c467ceed3375a5b0e508f8facc27cf1b7be034640c64eb9da738","observation_id":"5f98d0f3-a8f1-4db1-8eea-fbd1508a57d9","resolution":{"observed_at":"2026-08-15T22:17:39.227196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.235348Z","title":"Flexible Hierarchical Gaussian Mixture Model for High -Resolution Remote Sensing Image Segmentation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.235348Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:d5f8e052e3492d9b4e5db082a053f46d23badcd11fb9cdf4a085c201952a3f64","observation_id":"73cca219-abfd-40dc-a38e-7afad727d10d","resolution":{"observed_at":"2026-08-15T22:17:39.235348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.248215Z","title":"A BAYESIAN HIERARCHICAL MIXTURE OF GAUSSIAN MODEL FOR MULTI-SPEAKER DOA ESTIMATION AND SEPARATION,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.248215Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:5a13a06b8b762061813e201dc8dadd8a1de6c3d9a171d0f37a07c611cd667fd2","observation_id":"269403b6-8fe9-41d2-b676-87240409ea38","resolution":{"observed_at":"2026-08-15T22:17:39.248215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.265895Z","title":"Bayesian hierarchical mixture models for detecting non -normal clusters applied to noisy genomic and environmental datasets,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.265895Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:3dd03054f12add4288fbb1be1ad88da71720c91e87eb2437cac0cbb79ffef351","observation_id":"2c741e6b-3e51-41f8-80eb-41e8dbd57dd3","resolution":{"observed_at":"2026-08-15T22:17:39.265895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.287717Z","title":"A tutorial on Dirichlet process mixture modeling,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.287717Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:755ae3b2c18847f72aa7c917e2ec56e6b6fff4a7fd138415f5d134b56a68bf99","observation_id":"00a91781-25ae-4872-921c-a8f81149ddf3","resolution":{"observed_at":"2026-08-15T22:17:39.287717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.313631Z","title":"A tutorial on Bayesian nonparametric models,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.313631Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:e626ad31776f4d630a00bccb145953572725c05c16af95c18427f23b2783eb1f","observation_id":"f24f62e5-9a74-42c8-b86d-7bbae84c179a","resolution":{"observed_at":"2026-08-15T22:17:39.313631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.328883Z","title":"Context -Based Meta - Reinforcement Learning with Bayesian Nonparametric Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.328883Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:2ba7b8af7426ad1ac51c5bdadf5ab3ec962cfd60041d0e63097d2ec3cb0bb434","observation_id":"2b62243b-827d-49b1-b2d3-d343ceb6861e","resolution":{"observed_at":"2026-08-15T22:17:39.328883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.345828Z","title":"Model Selection for Mixture Models -Perspectives and Strategies,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.345828Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:2f8b2b9de716ba096f0c4f7d24aa1385bc1c0fcbe104824c478ccc6738a7a286","observation_id":"efb1c0ef-10de-4d58-abf5-cd3bf3d8d179","resolution":{"observed_at":"2026-08-15T22:17:39.345828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.351802Z","title":"Priors in Bayesian Deep Learning : A Review,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.351802Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:a5dd7fd8f3768812b08058a3b0f0125ab695cef129fa1fe2ed113caec10858df","observation_id":"2f2f34e5-1d71-4a2f-9c82-0d69a25d105b","resolution":{"observed_at":"2026-08-15T22:17:39.351802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.367749Z","title":"Bayesian Model-Agnostic Meta -Learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.367749Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:c85fbd11c7c7d4b635fa9e6fbdf32601c25aa6aa0ee6c145607336bfa7395e31","observation_id":"165855b5-38c1-4046-b26a-2c02a517358d","resolution":{"observed_at":"2026-08-15T22:17:39.367749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.395372Z","title":"Finite Mixture Models,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.395372Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:95009b3538b2314b0ff6040857e4ae39730314b19d97dc49a1ba7deb19851638","observation_id":"31266a44-cace-4699-b15e-8ad96925fc97","resolution":{"observed_at":"2026-08-15T22:17:39.395372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01122","last_updated":"2023-06-01T20:19:30Z","snapshot_observed_at":"2026-08-18T22:21:14.941449Z","submitted_at":"2023-06-01T20:19:30Z","title":"On the Convergence of Coordinate Ascent Variational Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01122","snapshot_observed_at":"2026-08-15T22:17:39.411804Z","title":"On the convergence of coordinate ascent variational inference,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.411804Z"},"links":{"cited_paper":"/paper/2306.01122","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:60decf943b6c03eb20b7441277eb4cdb62ce4947b9a2e73759bb3f6c1ccd3133","observation_id":"9a7a1390-b3fb-4265-89f5-4978604505e3","resolution":{"observed_at":"2026-08-15T22:17:39.411804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.435307Z","title":"Monte Carlo co -ordinate 19 Zhou, C. et al. Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review ascent variational inference,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.435307Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:fb9ac95dd689e6ab9b03da035ab8b7b0a494922924c55630409a4adc97bd7d6b","observation_id":"5ef39c18-017b-429e-986e-9b7131d20ce5","resolution":{"observed_at":"2026-08-15T22:17:39.435307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.448721Z","title":"Stochastic Optimization: A Review,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.448721Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:a7d229957c5b58b4ab06f92c114cf8f801553f38f26e04b080893a4e7671d552","observation_id":"2a998847-cda6-42d1-a366-5b40cfcfe1a6","resolution":{"observed_at":"2026-08-15T22:17:39.448721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.483953Z","title":"Stochastic Variational Inference,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.483953Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:36041cf70fcffc06d72d577667331acdd654c58353a7e004ee62b0c49469097e","observation_id":"9bd88d0c-e7d6-4716-9e0a-358aa0b73455","resolution":{"observed_at":"2026-08-15T22:17:39.483953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1206.2944","last_updated":"2012-08-29T06:36:23Z","snapshot_observed_at":"2026-08-18T04:25:34.706968Z","submitted_at":"2012-06-13T21:23:15Z","title":"Practical Bayesian Optimization of Machine Learning Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1206.2944","snapshot_observed_at":"2026-08-15T22:17:39.494425Z","title":"Practical Bayesian optimization of machine learning algorithms,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.494425Z"},"links":{"cited_paper":"/paper/1206.2944","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:11a6b2698ecdcac4def5072fc407352d1cd0b43ffc272731fca54516b3f1cb38","observation_id":"cfb5fac8-1940-49b6-8577-6aabcad584b4","resolution":{"observed_at":"2026-08-15T22:17:39.494425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.545333Z","title":"Computing the racing line using Bayesian optimization,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.545333Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:0c2add1bf38912d57f813d8245ca443a32398e3f624d30aacb079936a15f465f","observation_id":"b861c9f1-d852-4ac6-8f51-1f9ab6a1bfaf","resolution":{"observed_at":"2026-08-15T22:17:39.545333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.558193Z","title":"A New Method of Locating the Maximum Point of an Arbitrary Multipeak Curve in the Presence of Noise,","venue":null,"work_id":null,"year":1964},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.558193Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:7db64d14a2f6ac19b5c198a4a48e09a335ac54af14135f69a481c38f6fc72fe1","observation_id":"51e6a65a-bad5-4cd7-b30d-9b0f341b565d","resolution":{"observed_at":"2026-08-15T22:17:39.558193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.574575Z","title":"The application of Bayesian methods for seeking the extremum,","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.574575Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:573eedfc71972f4943311912cbab173c7aea6709c3fd8596478a805a2dab55fb","observation_id":"52c2b5f8-33a8-4821-b26c-321fac3c3dd3","resolution":{"observed_at":"2026-08-15T22:17:39.574575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.616057Z","title":"Generating Adversarial Driving Scenarios in High-Fidelity Simulators,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.616057Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:d44fd456cf06e4ffc5208d2e941833b4942b9a4a677086b892e807f7050211fe","observation_id":"56e57b06-6603-446f-a3c0-84a235850c9a","resolution":{"observed_at":"2026-08-15T22:17:39.616057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.12809","last_updated":"2021-04-28T12:58:19Z","snapshot_observed_at":"2026-08-18T23:05:23.179728Z","submitted_at":"2019-11-28T17:52:06Z","title":"Greed is Good: Exploration and Exploitation Trade-offs in Bayesian Optimisation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.12809","snapshot_observed_at":"2026-08-15T22:17:39.629766Z","title":"Greed is Good: Exploration and Exploitation Trade -offs in Bayesian Optimisation,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.629766Z"},"links":{"cited_paper":"/paper/1911.12809","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:269777fbe86589250b65661d25c4324be44dbf66eae7ae238c5570e83e4c81ed","observation_id":"241251e0-6d6b-4e23-8219-dec329486e89","resolution":{"observed_at":"2026-08-15T22:17:39.629766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1304.5350","last_updated":"2013-09-02T07:57:23Z","snapshot_observed_at":"2026-08-15T00:20:41.156394Z","submitted_at":"2013-04-19T09:11:34Z","title":"Parallel Gaussian Process Optimization with Upper Confidence Bound and Pure Exploration","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1304.5350","snapshot_observed_at":"2026-08-15T22:17:39.651255Z","title":"Upper confidence bound and pure exploration,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.651255Z"},"links":{"cited_paper":"/paper/1304.5350","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:050e1274a8579920a3da2df56a142238418cf54352783dd5618fefbd233fec4b","observation_id":"72bcab06-0159-439a-bfd4-080d742cdea8","resolution":{"observed_at":"2026-08-15T22:17:39.651255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.662573Z","title":"Entropy Search for Information - Efficient Global Optimization,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.662573Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:ab666c23aba1f30da4dde2971cec7ccdd82b16601611a52e5eee14cba9a8200d","observation_id":"e37888df-35a1-4b02-a913-3a1facbfc1f3","resolution":{"observed_at":"2026-08-15T22:17:39.662573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.673044Z","title":"Analysis of Thompson Sampling for the Multi -armed Bandit Problem,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.673044Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:f3fe659b9fd79c6c19244ea16f272f1a0f1729b0e36af3d09a5298a7ca8db5d0","observation_id":"dcfd3d5d-5c73-45db-a8bf-35069b5d33a3","resolution":{"observed_at":"2026-08-15T22:17:39.673044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.686151Z","title":"Sparse Spectrum Gaussian Process Regression,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.686151Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:f3f9269630bde5c20a7f4a602fcec7dc552d2f82277d0bbd92086ade8f7b340b","observation_id":"048d0b51-7adc-4567-9cbd-0883cb30ef4d","resolution":{"observed_at":"2026-08-15T22:17:39.686151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1406.2541","last_updated":"2014-06-10T13:29:09Z","snapshot_observed_at":"2026-08-14T23:30:54.526653Z","submitted_at":"2014-06-10T13:29:09Z","title":"Predictive Entropy Search for Efficient Global Optimization of Black-box Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.2541","snapshot_observed_at":"2026-08-15T22:17:39.702784Z","title":"Predictive Entropy Search for Efficient Global Optimization of Black-box Functions,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.702784Z"},"links":{"cited_paper":"/paper/1406.2541","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:2ea7123fddb8c579759779ea5492497830f000a9542f1a5edcf2d8a9d99362fc","observation_id":"eb88dac3-d608-4e67-9129-8347ea6c01ba","resolution":{"observed_at":"2026-08-15T22:17:39.702784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.01968","last_updated":"2018-01-02T18:05:14Z","snapshot_observed_at":"2026-08-14T21:13:18.078821Z","submitted_at":"2017-03-06T16:52:54Z","title":"Max-value Entropy Search for Efficient Bayesian Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.01968","snapshot_observed_at":"2026-08-15T22:17:39.719858Z","title":"Max -value Entropy Search for Efficient Bayesian Optimization,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.719858Z"},"links":{"cited_paper":"/paper/1703.01968","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:ae3b5174990a303e6dc63a7445c0d31bba60d62488b3e6092ae165a41ae869d5","observation_id":"889407fb-3f99-4c01-8c03-99dcb08f4206","resolution":{"observed_at":"2026-08-15T22:17:39.719858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1009.5419","last_updated":"2011-03-07T13:45:22Z","snapshot_observed_at":"2026-08-15T05:07:40.032142Z","submitted_at":"2010-09-28T00:41:45Z","title":"Portfolio Allocation for Bayesian Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1009.5419","snapshot_observed_at":"2026-08-15T22:17:39.741261Z","title":"Portfolio Allocation for Bayesian Optimization,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.741261Z"},"links":{"cited_paper":"/paper/1009.5419","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:bc78db68a6c2b2dbd5f2d6b9929c9fbe9c7cf5dfa9ddbef80b4b29d8347ef42f","observation_id":"223b931f-12de-434e-8e1d-406e2f5cc674","resolution":{"observed_at":"2026-08-15T22:17:39.741261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1406.4625","last_updated":"2015-03-04T21:25:31Z","snapshot_observed_at":"2026-08-18T23:33:30.091501Z","submitted_at":"2014-06-18T07:26:08Z","title":"An Entropy Search Portfolio for Bayesian Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.4625","snapshot_observed_at":"2026-08-15T22:17:39.749265Z","title":"An Entropy Search Portfolio for Bayesian Optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.749265Z"},"links":{"cited_paper":"/paper/1406.4625","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:4d1a9da455648a64eb82c1bf9f6b1dac96355a693b707416c813015b358f1eae","observation_id":"c554911a-90f3-4a90-aebc-7a24c219c8b3","resolution":{"observed_at":"2026-08-15T22:17:39.749265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.761646Z","title":"Deep Gaussian processes,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.761646Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:bcd8036ee38e3d1382720310bf8259eba504a1c1797ba437d57aac41de9c21ec","observation_id":"3f0b052e-01a9-4f88-b9c3-3f2cd07e2982","resolution":{"observed_at":"2026-08-15T22:17:39.761646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.775893Z","title":"Transforming Neural -Net Output Levels to Probability Distributions,","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.775893Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:5eb846195a1aa78df5594ac0a5a30df2bc41e1bbbb5a9a95ef2b21bb75bc6439","observation_id":"04139fc0-36b8-4dd2-b797-b3ef01d1d5a0","resolution":{"observed_at":"2026-08-15T22:17:39.775893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.789074Z","title":"Understanding the Metropolis -Hastings algorithm,","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.789074Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:68c0e4a7b6e9fba1ff8026739a740b74f16be1439d7b77dbd5e0bcc280c2e9d0","observation_id":"4b5e648e-5bb1-402f-a659-8e6a8b8b63e1","resolution":{"observed_at":"2026-08-15T22:17:39.789074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.804441Z","title":"Explaining the Gibbs Sampler,","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.804441Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:cc9bf0c8cac031068c3e95ebbb0ca5a53cc5e8e166f227a96448ba6b92f0d18d","observation_id":"5c223985-16c3-4304-9441-442cf6c85dd2","resolution":{"observed_at":"2026-08-15T22:17:39.804441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.814659Z","title":"Mean Field Variational Bayes for Elaborate Distributions,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.814659Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:f74629c3907f5c0f33e8e232c50b77dfa9404b5083678cf4dd045aceea03724c","observation_id":"b093e24c-94d7-4ea6-85b2-73920c3d6a05","resolution":{"observed_at":"2026-08-15T22:17:39.814659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.839602Z","title":"The Variational Gaussian Approximation Revisited,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.839602Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:70aaa6ebb34cf9dd27a202ccbabe9f6a1786de403f81c6d5a63574b4c91fc988","observation_id":"dbff1847-6ce2-4592-98fd-65cdeb209b30","resolution":{"observed_at":"2026-08-15T22:17:39.839602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.00712","last_updated":"2017-03-05T16:59:44Z","snapshot_observed_at":"2026-08-15T03:06:21.621383Z","submitted_at":"2016-11-02T18:25:40Z","title":"The Concrete Distribution: A Continuous Relaxation of Discrete Random Variables","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.00712","snapshot_observed_at":"2026-08-15T22:17:39.862283Z","title":"The Concrete Distribution: A Continuous Relaxation of Discrete Random Variables,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.862283Z"},"links":{"cited_paper":"/paper/1611.00712","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:e528b6cf0441bc2842e796d37dae9b816a2aa170fef5a2f77c7ca711aff0e440","observation_id":"8bd4d69e-2ef0-49ac-9ee5-ce6cede7aeb1","resolution":{"observed_at":"2026-08-15T22:17:39.862283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.06291","last_updated":"2023-02-20T12:32:21Z","snapshot_observed_at":"2026-08-16T16:16:52.123031Z","submitted_at":"2022-11-11T16:00:21Z","title":"Do Bayesian Neural Networks Need To Be Fully Stochastic?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.06291","snapshot_observed_at":"2026-08-15T22:17:39.876557Z","title":"Do Bayesian Neural Networks Need To Be Fully Stochastic?,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.876557Z"},"links":{"cited_paper":"/paper/2211.06291","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:ba068ff0546c111865dce0e3224e0fc2fe6dc86bb1950c3e0bf7e08da115f003","observation_id":"ad8494d9-c931-47a0-aeb0-833556be8ed7","resolution":{"observed_at":"2026-08-15T22:17:39.876557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.905781Z","title":"Dropout: A simple way to prevent neural networks from overfitting,","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.905781Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:17ea2b6b40b05a1e48509e7e6d8c96a2c950c32b9383d3ce2aca13cabbcd9c4f","observation_id":"c5c516b9-1c78-43c8-b697-1935a312521c","resolution":{"observed_at":"2026-08-15T22:17:39.905781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.941316Z","title":"Computing with infinite networks,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.941316Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:8c88d2566362fb852a83011e9888c69c2a853d9df1606f43e1db2635fb98bbda","observation_id":"ac48ab69-0da7-497d-aaf7-74a2210d8ae1","resolution":{"observed_at":"2026-08-15T22:17:39.941316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.949598Z","title":"Dropout as a Bayesian approximation: Representing model uncertainty in deep learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.949598Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:b45bf3412f775dcf6f50a266380a6e9f2ff6865e18fcd2986100356bda0777c2","observation_id":"2ba058cb-24d9-4f07-882b-f8258ce2c05a","resolution":{"observed_at":"2026-08-15T22:17:39.949598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:39.975593Z","title":"A Decentralized Bayesian Approach for Snake Robot Control,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:39.975593Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:16a1b1723a6306d728b618d102bc78ba15393a95ab7679bde2c327b0d25a8c8f","observation_id":"80aa89af-2e47-4e54-b48f-560bb23a2ff0","resolution":{"observed_at":"2026-08-15T22:17:39.975593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:40.012523Z","title":"Notes on the Behavior of MC Dropout,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:40.012523Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:b3c1888bf5b9eabf9e22ebaab1003bb33ecbd6df87ec2148ccdf60a45ba47521","observation_id":"6e7ad03e-125b-4641-8706-3f795115fb72","resolution":{"observed_at":"2026-08-15T22:17:40.012523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.05148","last_updated":"2020-08-21T15:28:27Z","snapshot_observed_at":"2026-08-14T18:16:04.276882Z","submitted_at":"2018-10-11T17:49:41Z","title":"Bayesian Deep Convolutional Networks with Many Channels are Gaussian Processes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.05148","snapshot_observed_at":"2026-08-15T22:17:40.040292Z","title":"Bayesian deep convolutional networks with many channels are Gaussian processes,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:40.040292Z"},"links":{"cited_paper":"/paper/1810.05148","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:3c246d6874e87e78d803b8312700a0b181b9686537479f7632b6d364a2571b27","observation_id":"91fb6884-e982-450e-959d-1ee47c1e1277","resolution":{"observed_at":"2026-08-15T22:17:40.040292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:40.056718Z","title":"Deep Predictive Models for Collision Risk Assessment in Autonomous Driving,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:40.056718Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:717c5978b8f8def184b9084baf3ebd331b3c4a4574362c6bb4b5bbfe889330fa","observation_id":"f505e33b-370f-4276-ba57-7c5d9e213a51","resolution":{"observed_at":"2026-08-15T22:17:40.056718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.03308","last_updated":"2019-11-26T11:36:03Z","snapshot_observed_at":"2026-08-13T15:08:44.357315Z","submitted_at":"2019-11-08T15:08:51Z","title":"Fully Bayesian Recurrent Neural Networks for Safe Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.03308","snapshot_observed_at":"2026-08-15T22:17:40.063345Z","title":"Fully Bayesian Recurrent Neural Networks for Safe Reinforcement Learning,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:40.063345Z"},"links":{"cited_paper":"/paper/1911.03308","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:538b06d2278775e7e92efd078d0dada8e46a9d08dc459ee999ee65951ab08572","observation_id":"111b8810-f769-4cdb-89bb-772623fc7592","resolution":{"observed_at":"2026-08-15T22:17:40.063345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:40.070557Z","title":"Deep similarity-based batch mode active learning with exploration-exploitation,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:40.070557Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:6a3e63933db3f8480477600774c2d225bd38638f7ae69e20db35384c5c121b3e","observation_id":"78bf7942-bde7-4a97-a5b6-2b5b93ca10b7","resolution":{"observed_at":"2026-08-15T22:17:40.070557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:40.077190Z","title":"Active Learning Literature Survey,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:40.077190Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:c776281628156fbe4bdfeddee226def798db2ff7fa8d7665fd133e6cb0b30119","observation_id":"683ba0c0-cb29-4ed4-9fea-1713dd780b80","resolution":{"observed_at":"2026-08-15T22:17:40.077190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.00489","last_updated":"2018-06-01T10:17:23Z","snapshot_observed_at":"2026-08-16T13:51:24.988660Z","submitted_at":"2017-08-01T19:50:53Z","title":"Active Learning for Convolutional Neural Networks: A Core-Set Approach","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.00489","snapshot_observed_at":"2026-08-15T22:17:40.084732Z","title":"Active Learning for Convolutional Neural Networks: A Core-Set Approach,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:40.084732Z"},"links":{"cited_paper":"/paper/1708.00489","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:cfdbf3afa92ed1a89897847fc45b21e3c50b604a74cdd85b6a53ade653719f27","observation_id":"3eac760b-8aae-4017-838d-37f85bb1b588","resolution":{"observed_at":"2026-08-15T22:17:40.084732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1112.5745","last_updated":"2011-12-24T17:53:19Z","snapshot_observed_at":"2026-08-17T04:17:54.065503Z","submitted_at":"2011-12-24T17:53:19Z","title":"Bayesian Active Learning for Classification and Preference Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1112.5745","snapshot_observed_at":"2026-08-15T22:17:40.097564Z","title":"Bayesian Active Learning for Classification and Preference Learning,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:40.097564Z"},"links":{"cited_paper":"/paper/1112.5745","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:27fab7d1a2eba3467b44734d6798c3229f5597efc8eadcc1f928f9f0e767fffd","observation_id":"0fa0bb60-c3bd-40f3-8cc4-bd6a7be9ae1e","resolution":{"observed_at":"2026-08-15T22:17:40.097564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:17:40.104776Z","title":"BatchBALD: Efficient and diverse batch acquisition for deep Bayesian active learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:40.104776Z"},"links":{"citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:e270ade4938d8a72d271f7a685959cae6e7c023f5ed92605c04b54067d4679dd","observation_id":"aa7676c7-a604-431a-9e4a-5de7f3e3a8e0","resolution":{"observed_at":"2026-08-15T22:17:40.104776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.02910","last_updated":"2017-03-08T16:53:57Z","snapshot_observed_at":"2026-08-14T21:12:51.179817Z","submitted_at":"2017-03-08T16:53:57Z","title":"Deep Bayesian Active Learning with Image Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.02910","snapshot_observed_at":"2026-08-15T22:17:40.116154Z","title":"Deep Bayesian Active Learning with Image Data,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:40.116154Z"},"links":{"cited_paper":"/paper/1703.02910","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:4679d07ce7ba9e961cb510074e6b26dc5fde9e6ec4e4c0d4f8a839e1c63aaf72","observation_id":"9f7c891a-02e0-4711-98a5-939c19567503","resolution":{"observed_at":"2026-08-15T22:17:40.116154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07761","last_updated":"2017-11-06T21:24:56Z","snapshot_observed_at":"2026-08-19T10:44:33.065861Z","submitted_at":"2017-05-22T14:17:57Z","title":"VEEGAN: Reducing Mode Collapse in GANs using Implicit Variational Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07761","snapshot_observed_at":"2026-08-15T22:17:40.128832Z","title":"VEEGAN: Reducing Mode Collapse in GANs using Implicit Variational Learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-15T22:17:40.128832Z"},"links":{"cited_paper":"/paper/1705.07761","citing_paper":"/paper/2505.07911"},"observation_digest":"sha256:b84e5990107baff098837ea87015e0e6e3775e40659c70ee7dab20ac94db72f7","observation_id":"74564979-15bd-41c9-8187-e4f85766cb38","resolution":{"observed_at":"2026-08-15T22:17:40.128832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.07911","last_updated":"2025-05-12T13:34:50Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T05:05:18.837905Z","submitted_at":"2025-05-12T13:34:50Z","title":"Combining Bayesian Inference and Reinforcement Learning for Agent Decision Making: A Review"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":300},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 100 of 300 outbound references and 0 inbound Pith citation observations for arXiv:2505.07911."}