{"as_of":"2026-08-16T01:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6d06b9e23c21297fd43ccd604b7bac99cce19561ef3c6f464f91eab0dc3b4ea7","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T16:15:59.662204Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.18077/citation-record","integrity":"/paper/2607.18077/integrity","json":"/paper/2607.18077/citation-record.json","paper":"/paper/2607.18077"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.371634Z","title":"More risk-sensitive Markov decision processes","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.371634Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:e833174872e4674747e4494dad5de1775c3635af6bc981919aa69da8aec6941d","observation_id":"ffc742ab-0b13-4bc2-94d9-843f1002321b","resolution":{"observed_at":"2026-08-01T16:15:59.371634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.375861Z","title":"Dynamic Programming","venue":null,"work_id":null,"year":1957},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.375861Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:8549c1ead405d10507d4793417a23c0ac3c9aa92d03f2a42e946a43d7cdaec81","observation_id":"28179dea-f592-4fd9-8ced-dc93330d61a8","resolution":{"observed_at":"2026-08-01T16:15:59.375861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.380215Z","title":"On aggregators and dynamic programming","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.380215Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:5b47cf557b9b4f8d0f4b8dccab4f4bee6b3baaa9ad6901d2bd1d0d94a39c32d9","observation_id":"334eac69-3b37-4f91-9e23-bf9b2a7df783","resolution":{"observed_at":"2026-08-01T16:15:59.380215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.384398Z","title":"A technical critique of some parts of the free energy principle","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.384398Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:dce713541d455dedb39433b3fd181813df7d7fbff50ae078df0f3072c8cba034","observation_id":"8ae3fe89-ef55-467c-8925-b59dc25c4313","resolution":{"observed_at":"2026-08-01T16:15:59.384398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.388345Z","title":"Functions resembling quotients of measures","venue":null,"work_id":null,"year":1966},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.388345Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:66919f49040f976c38b2f38f7fec42f9998ffaa78571bce970aa81d89edf737e","observation_id":"0a5aadb4-e1d1-45a2-b68b-fecffce962fb","resolution":{"observed_at":"2026-08-01T16:15:59.388345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12592","last_updated":"2022-07-08T14:09:54Z","snapshot_observed_at":"2026-08-13T16:17:06.656450Z","submitted_at":"2022-03-23T17:54:20Z","title":"Your Policy Regularizer is Secretly an Adversary","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12592","snapshot_observed_at":"2026-08-01T16:15:59.392261Z","title":"Your policy regularizer is secretly an adversary","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.392261Z"},"links":{"cited_paper":"/paper/2203.12592","citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:561b2b0699eda89ffa135517022650a385fe8222a399f6ce24147cf637473c7d","observation_id":"10f26e95-1182-45fe-a3e5-133456d05df1","resolution":{"observed_at":"2026-08-01T16:15:59.392261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.397377Z","title":"Profunctor optics, a categorical update","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.397377Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:c9aa53cfed329d259f5931c3461c85dd3cb3e6d8aeb38c28e61c353f08d9e939","observation_id":"dff832d6-dd04-4c19-adfb-ef4b18295738","resolution":{"observed_at":"2026-08-01T16:15:59.397377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.401123Z","title":"Active inference on discrete state-spaces: A synthesis","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.401123Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:1033703d884bdcd89c40a6d7d3e3c7fe4bf8952510e9e699114928f0604156ce","observation_id":"78350cfe-4f56-4462-865e-c6280113b66f","resolution":{"observed_at":"2026-08-01T16:15:59.401123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.405437Z","title":"Reward maximization through discrete active inference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.405437Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:f890b7e93688e86f8829af4f4fe9f07c1002d07676ae3d53966c0a4e494d3fa3","observation_id":"810c7aaa-cf19-4e38-a01e-7e871ae2abd6","resolution":{"observed_at":"2026-08-01T16:15:59.405437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.409196Z","title":"Probability is real, and value is complex, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.409196Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:81cef534b437e47b9383e2d0489a9a4ae830265fb6d8fc7229135def461f042f","observation_id":"df03345e-809e-4d64-ad4b-fc4bec704323","resolution":{"observed_at":"2026-08-01T16:15:59.409196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.412818Z","title":"Twice regularized MDP s and the equivalence between robustness and regularization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.412818Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:68dfdd966286117814b86fc7ff0c11b4f05aa281ad069d537a551df3831b5d9e","observation_id":"94735721-323e-441c-a3c4-d5626df09b8c","resolution":{"observed_at":"2026-08-01T16:15:59.412818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.416530Z","title":"Risk measures and comonotonicity: a review","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.416530Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:c5b287422fca2f21c003660f11702de1c2e3d78bb85837d73157e5d4b0b9db65","observation_id":"c31165dc-084f-4e18-99a0-c35815e7d547","resolution":{"observed_at":"2026-08-01T16:15:59.416530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.420513Z","title":"Optimal Learning: Computational Procedures for Bayes -Adaptive Markov Decision Processes","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.420513Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:f495920e46189ad4b0626be963ac5fe2e26964bf9f8b9ccce60cf79177dbe994","observation_id":"20491877-4b57-4a1c-b8c5-6e2918b6086d","resolution":{"observed_at":"2026-08-01T16:15:59.420513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.424324Z","title":"Robust properties of risk-sensitive control","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.424324Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:933dfd4b9a5c629bbb977a387d5a3130fa2d41899118942b69a188b150c8211f","observation_id":"60643b87-89d8-4532-91db-a9147c9bae96","resolution":{"observed_at":"2026-08-01T16:15:59.424324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.428595Z","title":"Long-term values in M arkov decision processes, (co)algebraically","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.428595Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:8a0cabb7fdd2986613d4f4a7f935528273a6b8c86be64dc1da6fd12a5d743c8f","observation_id":"2c280fca-e745-4d13-b8b4-dc7a6b131d2a","resolution":{"observed_at":"2026-08-01T16:15:59.428595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.432295Z","title":"Stochastic finance: an introduction in discrete time","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.432295Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:3d34b94c60d42b62da180c2ad637da77e818d20c031f4634cfbd13c6a2f15a0c","observation_id":"73867b3b-9d2d-415a-a273-dc0150d1ad6d","resolution":{"observed_at":"2026-08-01T16:15:59.432295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.436069Z","title":"The free-energy principle: A unified brain theory? Nature Reviews Neuroscience, 11 0 (2): 0 127--138, 2010","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.436069Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:e5ea659be35e2fab0a48f0718ca2cdcf56d8a041ff489ce88982cfed940dd87a","observation_id":"81310daf-b915-441a-8171-22c65bd1ce9c","resolution":{"observed_at":"2026-08-01T16:15:59.436069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.439691Z","title":"Active inference and epistemic value","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.439691Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:1d8d92c9e9536e4745dbe5d3f2b4d2ef68fda0c808dafe61c44239f06df25c8c","observation_id":"95676d9c-f17f-4491-8be8-7ad9f5b44667","resolution":{"observed_at":"2026-08-01T16:15:59.439691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.443366Z","title":"Sophisticated inference","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.443366Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:fee79faf65df65174774bb1cee87d724241af5440d46a79658e31a6bd6568581","observation_id":"1cf1f526-471a-4c7d-aae1-6e81265970e7","resolution":{"observed_at":"2026-08-01T16:15:59.443366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.448157Z","title":"A synthetic approach to Markov kernels, conditional independence and theorems on sufficient statistics","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.448157Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:b5471cbb0f4afc357f3795a6b309baf11a0a33a8c43c244c83c95dc77493b012","observation_id":"dfbb5174-323c-43e5-8bb0-566f70e7a3dd","resolution":{"observed_at":"2026-08-01T16:15:59.448157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.452055Z","title":"A theory of regularized M arkov decision processes","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.452055Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:4e1cea4916368078903cd4705b4c0c81373eaeb3e8f9e8725b0a4ae60cf169a0","observation_id":"0402aa46-7ac3-4668-b7e0-041899242f2d","resolution":{"observed_at":"2026-08-01T16:15:59.452055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.455868Z","title":"Bayesian reinforcement learning: A survey","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.455868Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:b9b145189b5b251a57126ac8df8c138f950da17ee19571a468d98171bcd4f962","observation_id":"7f1e76ab-5b9f-4e2f-99af-1c0bdf9ee635","resolution":{"observed_at":"2026-08-01T16:15:59.455868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.459632Z","title":"Maxmin expected utility with non-unique prior","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.459632Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:1c5afaaab3d8c9928b08215942d37b72f2c5540db6a7e7aa95e855dc898168a2","observation_id":"febd5326-8d89-42d4-8bbb-5921091d0efa","resolution":{"observed_at":"2026-08-01T16:15:59.459632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.463443Z","title":"The minimum description length principle","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.463443Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:13883f716109adbdbc76222bc38ef979a5276da6fd698b6b672ce38ea1836061","observation_id":"31f73dc7-3d37-447b-af8c-1d427399b9e0","resolution":{"observed_at":"2026-08-01T16:15:59.463443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.467440Z","title":"Reinforcement learning with deep energy-based policies","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.467440Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:812970bfdaeecefe04449f2f55d6afd971b7b621bac3b34cfbb91082e136d546","observation_id":"96c33bbe-a9e2-4a38-9f0a-79b9c40b2860","resolution":{"observed_at":"2026-08-01T16:15:59.467440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.471210Z","title":"Robustness","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.471210Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:e74b5acb4d8c788b01cbd1b1b80b8af654eeae2e95e553bc97c6d6e94304e68d","observation_id":"3a45ce98-b03e-4ab9-86f7-a8da3ec688d6","resolution":{"observed_at":"2026-08-01T16:15:59.471210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.474941Z","title":"Value iteration is optic composition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.474941Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:939d31ccb142375032aca9b00a4088488019363f916cdc7b2e43687030bcb892","observation_id":"23a7255d-ccce-4406-bddb-78c8d216304d","resolution":{"observed_at":"2026-08-01T16:15:59.474941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.478569Z","title":"Reinforcement learning in categorical cybernetics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.478569Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:e9e7b7238a218ce483143fc404c740839ffebbe7525b29185b576d31795ebcaa","observation_id":"8ef07995-9b7c-4b41-8882-ebbed4926fe4","resolution":{"observed_at":"2026-08-01T16:15:59.478569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.482214Z","title":"Risk-sensitive Markov decision processes","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.482214Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:8621cb5c2c48e11c61ce6d9ea5b0827ddb2c8a272361d5ad20c5b889ab97f206","observation_id":"229ff1e1-2017-4105-ba69-7920a37575c1","resolution":{"observed_at":"2026-08-01T16:15:59.482214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.485752Z","title":"Regularized policies are reward robust","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.485752Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:b6d5618089db9d0d7d298613cfd0c09d075659717d25f0c9a80e30119ba2e735","observation_id":"bab85494-2b4e-4472-84f5-76d0f8526ff9","resolution":{"observed_at":"2026-08-01T16:15:59.485752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.489424Z","title":"Using reward machines for high-level task specification and decomposition in reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.489424Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:18f2f920c99c0e12a91367d74fec1d7099ff53bc3418841df75425369362503c","observation_id":"210da3a4-18f3-4f29-abe1-c252505aed45","resolution":{"observed_at":"2026-08-01T16:15:59.489424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.492978Z","title":"Robust dynamic programming","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.492978Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:33e1ced0e979f4ff470c9149cb585c751bea8c15faf13e252c2f568e3588f170","observation_id":"870b5538-10cc-42ae-b6e1-f969e74c3298","resolution":{"observed_at":"2026-08-01T16:15:59.492978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.497036Z","title":"The Logic of Decision","venue":null,"work_id":null,"year":1965},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.497036Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:81b6011d13047cd3be67a173b6235fe0d6fbb650402ccd72c54c9608877b5499","observation_id":"4d5299cd-cebb-4136-8e4d-6a4e3c970972","resolution":{"observed_at":"2026-08-01T16:15:59.497036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.501602Z","title":"Planning and acting in partially observable stochastic domains","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.501602Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:731fe691aa807733fd6ea39da3a768a31872c269ebd26ab70e30f62e778a5578","observation_id":"30339793-4c1b-4b37-a8ab-4e0eb21afd07","resolution":{"observed_at":"2026-08-01T16:15:59.501602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.506589Z","title":"Optimal control as a graphical model inference problem","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.506589Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:8e67c147dc32e982b4db4d97597bbe39f228221394fcfa985e80c6cfc4db4e16","observation_id":"a8d2c167-c059-437d-bb7d-2e983ca9866a","resolution":{"observed_at":"2026-08-01T16:15:59.506589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.510428Z","title":"Empowerment: A universal agent-centric measure of control","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.510428Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:a1e548e636de348bc96815bd19321afe1c9c83970eb5dd666ee237a146385de4","observation_id":"9b23e04e-8917-446f-a6d8-0bb6ae8dae83","resolution":{"observed_at":"2026-08-01T16:15:59.510428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.00909","last_updated":"2018-05-20T20:03:59Z","snapshot_observed_at":"2026-08-08T20:31:18.897748Z","submitted_at":"2018-05-02T17:11:20Z","title":"Reinforcement Learning and Control as Probabilistic Inference: Tutorial and Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.00909","snapshot_observed_at":"2026-08-01T16:15:59.514423Z","title":"Reinforcement learning and control as probabilistic inference: Tutorial and review","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.514423Z"},"links":{"cited_paper":"/paper/1805.00909","citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:4a4ffd66ccf0e748caae4c2969aa111033503e8ed4600d9315a9a9611608c699","observation_id":"c2337141-4ec6-4bac-af95-b074abc0c67f","resolution":{"observed_at":"2026-08-01T16:15:59.514423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.518681Z","title":"The Kelly capital growth investment criterion: Theory and practice, volume 3","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.518681Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:d46da2f65e3bf27ba150cabf6e6ab335244bb53c790caad7e9e3dc346f5f2f21","observation_id":"8dba06bf-2d54-4f88-875b-7cf5ffa3881f","resolution":{"observed_at":"2026-08-01T16:15:59.518681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.522306Z","title":"A retrospective on active inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.522306Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:9725ca04213d3d15d09961204f21d7cfc49506c2741b26a76c70dd2fa9a2e085","observation_id":"2b92f343-7b70-479d-98aa-f82a46713413","resolution":{"observed_at":"2026-08-01T16:15:59.522306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.12964","last_updated":"2020-06-29T14:52:52Z","snapshot_observed_at":"2026-08-12T15:14:31.756813Z","submitted_at":"2020-06-23T13:03:58Z","title":"On the Relationship Between Active Inference and Control as Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.12964","snapshot_observed_at":"2026-08-01T16:15:59.526793Z","title":"On the relationship between active inference and control as inference","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.526793Z"},"links":{"cited_paper":"/paper/2006.12964","citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:8155a9aadb90c775c4218d93144e2d8b7d6a972b58b4ed6c28fab34174d660c4","observation_id":"0bda69d2-8cdc-4c5e-b1ff-a4e0dface56b","resolution":{"observed_at":"2026-08-01T16:15:59.526793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.530935Z","title":"Whence the expected free energy? Neural Computation, 33 0 (2): 0 447--482, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.530935Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:b8a3709497fa68070379e2f2ecf67257e20c9ec485f7470e6dfd088c92ca02ed","observation_id":"4ba1c8a7-dfa5-4f0e-9b3d-d74726984fbb","resolution":{"observed_at":"2026-08-01T16:15:59.530935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.534628Z","title":"Thermodynamics of exponential Kolmogorov--Nagumo averages","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.534628Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:eb359dbf5dbf527e228b1ab4b61f1ab4e781ea053e76e20bb65eb41add0f41c7","observation_id":"5e01aa84-99a3-47d3-a746-277fc2692ae0","resolution":{"observed_at":"2026-08-01T16:15:59.534628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.539019Z","title":"Bridging the gap between value and policy based reinforcement learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.539019Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:a47267a681cfc17e135ab1cf5df0355aa2d397799b68436a5827b7cb0681a664","observation_id":"0f0af7a2-dbd9-437d-a042-dbe83b276272","resolution":{"observed_at":"2026-08-01T16:15:59.539019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.542612Z","title":"Uncertainty in all its flavours, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.542612Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:ac12341e68e7751328aa3d84b1e2bf0ff4c336f2a7a814ff985e59d237768e4a","observation_id":"8db10b79-2db5-45fa-8cfe-27997ab94c82","resolution":{"observed_at":"2026-08-01T16:15:59.542612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.546659Z","title":"Robust control of Markov decision processes with uncertain transition matrices","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.546659Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:f9a328e8ba96962eaa0dfe6c540adb0fc9a4dfe0136ad531d11293c5aa5cb5aa","observation_id":"8c3bd16c-5450-4bed-a8e9-64dac0fc430e","resolution":{"observed_at":"2026-08-01T16:15:59.546659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.551647Z","title":"Discovering reinforcement learning algorithms","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.551647Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:2ce22d100f21bc4ec787c055e2106af95cdee16716dbb4f9be0330afca22a3fc","observation_id":"790c0606-11ff-4038-ae6b-4582519e001e","resolution":{"observed_at":"2026-08-01T16:15:59.551647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.555289Z","title":"Thermodynamics as a theory of decision-making with information-processing costs","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.555289Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:b9c2e15b55cfc8f939bf19284037b1ef77ade96606937bf2138a481ab9a3dde7","observation_id":"724a4e1b-8222-4728-8ecc-723fb10621a9","resolution":{"observed_at":"2026-08-01T16:15:59.555289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1604.05129","last_updated":"2016-05-29T18:39:52Z","snapshot_observed_at":"2026-08-14T22:01:13.299559Z","submitted_at":"2016-04-18T13:17:55Z","title":"Memory shapes time perception and intertemporal choices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.05129","snapshot_observed_at":"2026-08-01T16:15:59.559021Z","title":"Memory shapes time perception and intertemporal choices","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.559021Z"},"links":{"cited_paper":"/paper/1604.05129","citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:1224ed5f8cc31d851b070f4fd338ceeff32a9d7cfd6fb4b2c56aff6acd93606c","observation_id":"4c9db00d-c340-4170-bda1-ac36d38e2802","resolution":{"observed_at":"2026-08-01T16:15:59.559021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1512.06789","last_updated":"2015-12-21T19:58:46Z","snapshot_observed_at":"2026-08-14T22:17:32.002289Z","submitted_at":"2015-12-21T19:58:46Z","title":"Information-Theoretic Bounded Rationality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.06789","snapshot_observed_at":"2026-08-01T16:15:59.563117Z","title":"Information-theoretic bounded rationality","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.563117Z"},"links":{"cited_paper":"/paper/1512.06789","citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:a19286bb6ea068b29152d2413b95568e555ba082ef18ffddf6fe0ec8f924eb48","observation_id":"e90d4f14-36e4-4c6f-97ae-1cfbab79321c","resolution":{"observed_at":"2026-08-01T16:15:59.563117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.567131Z","title":"Robustness and risk-sensitivity in M arkov decision processes","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.567131Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:c6eca6804df93d7e15f101a53ce37080842fc97d88a8e6f3519e47b7978f337b","observation_id":"1af0a792-28a6-4934-b59e-593ab8e9c5ef","resolution":{"observed_at":"2026-08-01T16:15:59.567131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.570713Z","title":"What is intrinsic motivation? a typology of computational approaches","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.570713Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:4f038b2ef6b7e3b424e6a42df73c0db2d3728bbf1a8b460fcb36b7c9e9e52f00","observation_id":"5a34b895-cbd0-41c4-a2b5-36d2c47578b8","resolution":{"observed_at":"2026-08-01T16:15:59.570713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.574336Z","title":"Active Inference: The Free Energy Principle in Mind, Brain, and Behavior","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.574336Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:c11a013a502ba6c632fd05ab6278842e53c92a6e86ca9a5fcd4e53f2e184cab0","observation_id":"008b12f4-53b1-43fa-a91c-779111e27d0c","resolution":{"observed_at":"2026-08-01T16:15:59.574336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.577915Z","title":"Curiosity-driven exploration by self-supervised prediction","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.577915Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:679f0f12be2fda1131683b0d2d0976c2fa7660861ebc3a8507ee62c3d21011d8","observation_id":"419ea866-9862-46d3-877a-e92d304bfd91","resolution":{"observed_at":"2026-08-01T16:15:59.577915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.581571Z","title":"Minimax optimal control of stochastic uncertain systems with relative entropy constraints","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.581571Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:055359eafc2a9d984fd897dae016f7218e04634430a8fd29206cac44bc3eaa14","observation_id":"60271b4e-6134-4750-9de8-8196de4d953b","resolution":{"observed_at":"2026-08-01T16:15:59.581571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.586042Z","title":"Markov Decision Processes: Discrete Stochastic Dynamic Programming","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.586042Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:b195791cc94d94130deb218575f0cc6ea780f8dc9cdddfc9eb32404f20df15fc","observation_id":"26eeb1bc-48ad-4ffb-874e-834bb24d643c","resolution":{"observed_at":"2026-08-01T16:15:59.586042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.10228","last_updated":"2021-09-29T05:12:35Z","snapshot_observed_at":"2026-08-14T16:11:52.395078Z","submitted_at":"2019-06-24T20:47:42Z","title":"A Theoretical Connection Between Statistical Physics and Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.10228","snapshot_observed_at":"2026-08-01T16:15:59.589561Z","title":"A theoretical connection between statistical physics and reinforcement learning","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.589561Z"},"links":{"cited_paper":"/paper/1906.10228","citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:6ca7e5cd3a234ba7b79f1bfd96a147bb00a9a99e6112f328f76e9d02b6914a40","observation_id":"78c3847a-af5a-4c83-ae19-2030deda7dc5","resolution":{"observed_at":"2026-08-01T16:15:59.589561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.00738","last_updated":"2018-09-07T13:43:44Z","snapshot_observed_at":"2026-08-14T18:33:33.190739Z","submitted_at":"2018-09-03T22:30:12Z","title":"Categories of Optics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.00738","snapshot_observed_at":"2026-08-01T16:15:59.593791Z","title":"Categories of optics","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.593791Z"},"links":{"cited_paper":"/paper/1809.00738","citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:ba825d872aa765ed17295a6af6aa8898cc5c88fad00a6cc9ee07d8d448fa585b","observation_id":"cd27e9ca-3714-41af-9fe3-7ef231cc95ac","resolution":{"observed_at":"2026-08-01T16:15:59.593791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.597547Z","title":"Optimization of conditional value-at-risk","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.597547Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:583171af2694b634c92d1d77405e148dbd8868a3efecb75977684e3f50824846","observation_id":"58a2203b-02e3-4cce-b1a1-527352246b57","resolution":{"observed_at":"2026-08-01T16:15:59.597547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.601185Z","title":"Learning to optimize via information-directed sampling","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.601185Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:ac539b3aeed22059dbc42f047d3140f109479f0f9836a1c0223fad21376d2914","observation_id":"dc1c3bbc-d557-487c-b525-d99b14eed33b","resolution":{"observed_at":"2026-08-01T16:15:59.601185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.604815Z","title":"Learning to optimize via information-directed sampling","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.604815Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:e5f451e2d6756d1c32a1240b1b0bd352c75d4cb9e2904a959de3b08849fd716b","observation_id":"af27c273-8d12-472e-bf21-e7e088488784","resolution":{"observed_at":"2026-08-01T16:15:59.604815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.608479Z","title":"Active inference: Demystified and compared","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.608479Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:599848a1bbb8f82b1b5ab09d4b14cf2896252ecb39654aa9774545f77a521649","observation_id":"83fc87fe-f1a9-4bce-9ee1-1f70957aad57","resolution":{"observed_at":"2026-08-01T16:15:59.608479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.612242Z","title":"Empowerment: An introduction","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.612242Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:4f3e66d1c6ccfc75b04b0bb03176f76a9996737ac70378d1523e9ce83aa5fa5a","observation_id":"32c8be25-90c4-4ac7-9ffd-1319810e25e6","resolution":{"observed_at":"2026-08-01T16:15:59.612242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.615922Z","title":"The foundations of statistics","venue":null,"work_id":null,"year":1954},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.615922Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:b7ef73fe8a565ddadfa5aaef36c93645e9e64e625a3931aa9a5fc351e21661e8","observation_id":"953ed6fe-2d04-4f3b-8d2e-deafb747473e","resolution":{"observed_at":"2026-08-01T16:15:59.615922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.620015Z","title":"Subjective probability and expected utility without additivity","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.620015Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:61964b77661639dd70b70ad54f33d94f073ffede984967ba3f1c3df0e0b61094","observation_id":"1f503193-a6e6-4a8d-b185-2bf2e4b52cfe","resolution":{"observed_at":"2026-08-01T16:15:59.620015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.06440","last_updated":"2018-10-14T22:54:38Z","snapshot_observed_at":"2026-08-14T21:05:37.779686Z","submitted_at":"2017-04-21T08:33:59Z","title":"Equivalence Between Policy Gradients and Soft Q-Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.06440","snapshot_observed_at":"2026-08-01T16:15:59.623826Z","title":"Equivalence between policy gradients and soft q-learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.623826Z"},"links":{"cited_paper":"/paper/1704.06440","citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:ea237ed460869dfd364ed0e8da6f6c732289dbdba99d7a17210a209a2fd8c46a","observation_id":"748701e4-9379-4e76-a671-25b8f93dc676","resolution":{"observed_at":"2026-08-01T16:15:59.623826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.627762Z","title":"Horde: A scalable real-time architecture for learning knowledge from unsupervised sensorimotor interaction","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.627762Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:eb8ec0e5d0c2a5a58bc9c52166a499f9cb580c0d2f47871102ce33a0c9aee912","observation_id":"55bb9105-f4dc-4591-b124-e59da48ee47a","resolution":{"observed_at":"2026-08-01T16:15:59.627762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.631448Z","title":"Recursive reward aggregation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.631448Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:71d9f281de05ddd318ad89c5c14fe28ef8cb7d33f5f492d8ca7a7d630e3f8e64","observation_id":"f5de65f6-ec91-4ee8-a2d2-05de06f068bc","resolution":{"observed_at":"2026-08-01T16:15:59.631448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.635189Z","title":"Linearly-solvable Markov decision problems","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.635189Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:1de5d4e5bab2f9a9dbb21c47fe40380a5b34242b2a64c126deba5cc688f55d04","observation_id":"5fa6786a-7f25-4f45-84d2-2559ae6373f6","resolution":{"observed_at":"2026-08-01T16:15:59.635189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.639216Z","title":"Theory of games and economic behavior","venue":null,"work_id":null,"year":1944},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.639216Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:7d54d551754455362b7cdfad76f38fff9159ec09816187ea171c7c355208f63a","observation_id":"f809200f-b675-4d27-b876-965be97a2d02","resolution":{"observed_at":"2026-08-01T16:15:59.639216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.643022Z","title":"Utility maximization = description length minimization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.643022Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:d53a1f06ed3b1d919cf8554e47e139bc2892abba712ebcc35137528020d31dac","observation_id":"f2977e1a-0edc-4c24-86d7-84aa7ed564ef","resolution":{"observed_at":"2026-08-01T16:15:59.643022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.646665Z","title":"Risk-sensitive linear/quadratic/ Gaussian control","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.646665Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:6ca35cd7e8e4e19f9575f72870b9dc76defab70873601a581d6c0de070a115a0","observation_id":"eaaebf2b-f4a6-4ce3-8dfa-b14772886cd0","resolution":{"observed_at":"2026-08-01T16:15:59.646665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.650583Z","title":"Robust Markov decision processes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.650583Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:76cdd90f50bb0818ae0e448f6160b14691105237692e84b9c8f5ae3816b74fe1","observation_id":"64ab9e20-b00d-43a5-8dd0-7fcef58f71e4","resolution":{"observed_at":"2026-08-01T16:15:59.650583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.654314Z","title":"The dual theory of choice under risk","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.654314Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:21e2e248c08d7571a6a366900d8bfd8aa6e3f8355523691296261600a260553f","observation_id":"f7b0c513-7ea8-41aa-8311-c887d582c1aa","resolution":{"observed_at":"2026-08-01T16:15:59.654314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.658344Z","title":"Modeling Purposeful Adaptive Behavior with the Principle of Maximum Causal Entropy","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.658344Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:6df6f037792295d9cf4990e54e19e340340f92b49c5b6c0cfc200d4030d4139e","observation_id":"6bb34866-3154-4fba-baeb-7d6cecb915de","resolution":{"observed_at":"2026-08-01T16:15:59.658344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:15:59.662204Z","title":"VariBAD : A very good method for Bayes -adaptive deep RL via meta-learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-01T16:15:59.662204Z"},"links":{"citing_paper":"/paper/2607.18077"},"observation_digest":"sha256:9c324a05b028c6168aa78c94451fd2a605b368cbab7d014b5a689cf651cfbe90","observation_id":"2590a617-743d-44be-98c7-0437621aacc2","resolution":{"observed_at":"2026-08-01T16:15:59.662204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18077","last_updated":"2026-07-20T15:46:19Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T19:26:49.874131Z","submitted_at":"2026-07-20T15:46:19Z","title":"Generalised Bellman recurrence and three dualities in sequential decision-making"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":75,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 0 inbound Pith citation observations for arXiv:2607.18077."}