{"as_of":"2026-08-10T05:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1646a48d12c88df0d5f001fc42da2a6557b04f9bc7fa3b04fdd77e371776f3fc","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T15:02:10.268300Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.18589/citation-record","integrity":"/paper/2607.18589/integrity","json":"/paper/2607.18589/citation-record.json","paper":"/paper/2607.18589"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1806.01261","last_updated":"2018-10-17T17:51:36Z","snapshot_observed_at":"2026-07-06T06:42:54.610341Z","submitted_at":"2018-06-04T17:58:18Z","title":"Relational inductive biases, deep learning, and graph networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.01261","snapshot_observed_at":"2026-08-01T15:02:07.135079Z","title":"Battaglia, Jessica B","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.135079Z"},"links":{"cited_paper":"/paper/1806.01261","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:102f56fe5a166750d9358f515814e01ccfc295fa99dd855e701c08fdae3b4b62","observation_id":"7175be2c-5a82-4c74-83cd-8182aa26c547","resolution":{"observed_at":"2026-08-01T15:02:07.135079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.185967Z","title":"Interpreting emergent planning in model-free reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.185967Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:dab111eb47f6fe07a47638c3591ca3dc0f37dfd74b220eeeb2fd3ee13fbe6cb6","observation_id":"21c47137-978d-45ae-b1c3-b57e1e39931c","resolution":{"observed_at":"2026-08-01T15:02:07.185967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.266292Z","title":"Cohen and Howard Eichenbaum.Memory, Amnesia, and the Hippocampal System","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.266292Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:720438703e592812cef432cc85a099cfb86174add6faa14b15129a64f48eaadb","observation_id":"ad7b2732-9443-42a4-89f4-fa3688995c6d","resolution":{"observed_at":"2026-08-01T15:02:07.266292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06258","last_updated":"2025-08-04T03:29:30Z","snapshot_observed_at":"2026-08-09T03:04:18.558302Z","submitted_at":"2025-02-10T08:48:10Z","title":"Emergent Response Planning in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06258","snapshot_observed_at":"2026-08-01T15:02:07.349920Z","title":"Emergent response planning in LLMs, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.349920Z"},"links":{"cited_paper":"/paper/2502.06258","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:c67f1a9cd50c00944bada762c5036a7cf93036d3a0d11a45f7734c35de89ef1f","observation_id":"88b8a5a6-bec6-4c7b-8845-698c480b8931","resolution":{"observed_at":"2026-08-01T15:02:07.349920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.430836Z","title":"On the integration of space, time, and memory.Neuron, 95(5):1007–1018,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.430836Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:f12602adcd3b0e3279c3ea2c52123578f864298831dd37a58a1c238654a716df","observation_id":"eda69215-df16-4d0e-b26e-cb5c3d912bac","resolution":{"observed_at":"2026-08-01T15:02:07.430836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.556389Z","title":"IM- PALA: Scalable distributed deep-RL with importance weighted actor-learner architectures","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.556389Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:fef05fec6b0f9e7ec0644870a5b227ea21337ad1179405e9ec9adccac29b1af8","observation_id":"139b592d-c656-4a31-a783-721bdb8889f1","resolution":{"observed_at":"2026-08-01T15:02:07.556389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.641623Z","title":"Hybrid computing using a neural network with dynamic external memory.Nature, 538(7626): 471–476, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.641623Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:f36bdbbbf1dd030bffbf84f6c770fd7503aaec66364470e5bb61334d9f63051a","observation_id":"138a9800-8a70-47c1-85af-933b6add9294","resolution":{"observed_at":"2026-08-01T15:02:07.641623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.07771","last_updated":"2017-03-14T21:27:03Z","snapshot_observed_at":"2026-08-03T22:03:58.240131Z","submitted_at":"2016-12-22T19:57:35Z","title":"Highway and Residual Networks learn Unrolled Iterative Estimation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.07771","snapshot_observed_at":"2026-08-01T15:02:07.707423Z","title":"Srivastava, and Jürgen Schmidhuber","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.707423Z"},"links":{"cited_paper":"/paper/1612.07771","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:4fb7ecbf14ba917119229405ff7eabe1fc7146a8a36249a963c45046506213cb","observation_id":"f0211f95-3e38-422b-b997-ee3247d0b762","resolution":{"observed_at":"2026-08-01T15:02:07.707423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.755937Z","title":"An investigation of model-free planning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.755937Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:a1a5ccddbac50b56d627448a9f02522fbe6d2217906608561fad6c9679880876","observation_id":"65152fbd-010f-41d6-a396-a23689fac086","resolution":{"observed_at":"2026-08-01T15:02:07.755937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-07-31T21:36:45.596575Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-01T15:02:07.858752Z","title":"World models, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.858752Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:aedff887deb49ef5162cd2fb685041a272020e3426727dfa58aaf8ddfb94ccf7","observation_id":"8a999ab7-8275-4085-83e2-8241eccc7856","resolution":{"observed_at":"2026-08-01T15:02:07.858752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.942708Z","title":"Learning latent dynamics for planning from pixels","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.942708Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:442db6c2b3f4e83a4824b0ba9e8c874d9bb8e775bcc2b755f9b922997f371bd4","observation_id":"2e6ceb7b-c584-4c50-bc92-d9583185caef","resolution":{"observed_at":"2026-08-01T15:02:07.942708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-01T15:02:08.014108Z","title":"Mastering diverse domains through world models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.014108Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:11b010958f5c50f5b7115d52ffc75626cfe121840d471bb9356a9680b8ee1f8d","observation_id":"85994764-c10a-4269-9d1a-861554acd880","resolution":{"observed_at":"2026-08-01T15:02:08.014108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00877","last_updated":"2024-06-02T21:57:32Z","snapshot_observed_at":"2026-08-09T21:01:28.567469Z","submitted_at":"2024-06-02T21:57:32Z","title":"Evidence of Learned Look-Ahead in a Chess-Playing Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00877","snapshot_observed_at":"2026-08-01T15:02:08.102796Z","title":"Evidence of learned look-ahead in a chess-playing neural network","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.102796Z"},"links":{"cited_paper":"/paper/2406.00877","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:b17633a470a0c881139af7acf16c4f3caed65c4c9438e6af94cde41e9309adfe","observation_id":"18781938-fef4-4540-bbc8-5594c53a825e","resolution":{"observed_at":"2026-08-01T15:02:08.102796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:08.196707Z","title":"An empirical exploration of recurrent network architectures","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.196707Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:abbed3b235eb7282480a8d620ce744b55bc4be019400681055accf39d5c09da1","observation_id":"dc309a59-8dd9-49f8-bf1f-fdb5ddcc6e27","resolution":{"observed_at":"2026-08-01T15:02:08.196707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16236","last_updated":"2020-08-31T11:09:32Z","snapshot_observed_at":"2026-08-06T23:24:28.908251Z","submitted_at":"2020-06-29T17:55:38Z","title":"Transformers are RNNs: Fast Autoregressive Transformers with Linear Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.16236","snapshot_observed_at":"2026-08-01T15:02:08.396594Z","title":"Transformers are RNNs: Fast autoregressive transformers with linear attention, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.396594Z"},"links":{"cited_paper":"/paper/2006.16236","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:405761ea1bf9db553ecea998cb932e50257e500536ecb960e0bbcbc4f9789682","observation_id":"a313df4e-2275-461a-ae53-5a001b719130","resolution":{"observed_at":"2026-08-01T15:02:08.396594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:08.466587Z","title":"Neural rela- tional inference for interacting systems","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.466587Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:68455560af65812654700b6a1706ce393e4bfda99c79fbd15152e2ca6b612af5","observation_id":"9e2f8787-29d7-45c7-a28e-2339186de769","resolution":{"observed_at":"2026-08-01T15:02:08.466587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:08.626712Z","title":"Actor-critic algorithms","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.626712Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:d5134a84efee72af88e0ede0bae8f4d05bc583e1d90432cd753b89dffcca9c33","observation_id":"6e5ce3d9-56da-43db-aee4-ec5054d8097e","resolution":{"observed_at":"2026-08-01T15:02:08.626712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3389/neuro.01.023.2009","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Frontiers in Neuroscience","work_id":"1cacccc5-bf2d-4083-9f40-3630ae99729b","year":2009},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.690441Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:7eee440689864db0836342cc0baf7d706cd614ba2d849821267b73a11bf7e6a0","observation_id":"c44de500-899b-4947-9050-536b1ec00fa1","resolution":{"observed_at":"2026-08-01T15:03:26.606056Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:08.746027Z","title":"Lambert, Brandon Amos, Omry Yadan, and Roberto Calandra","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.746027Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:9872feb2a133c57e34f62f871cce1cc299a3b2d5d4e6080fc005e2b1800cd495","observation_id":"2d2ae8f8-48b3-4f16-976f-e7f402591358","resolution":{"observed_at":"2026-08-01T15:02:08.746027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:08.922477Z","title":"Hopkins, David Bau, Fernanda Viégas, Hanspeter Pfister, and Martin Wattenberg","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.922477Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:d9104bc2631c97e2b66b3fa341d575ee3e2d08cb2e813527899c0fe4fefe1756","observation_id":"286f2150-bd29-4b40-b0b9-82e858668d62","resolution":{"observed_at":"2026-08-01T15:02:08.922477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.006973Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.006973Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:2397674fb1b87e3809de08fbcd5f4802406919411372820145303c44bc3ed52b","observation_id":"569930b3-89d8-4396-bee1-3f84ae1ac784","resolution":{"observed_at":"2026-08-01T15:02:09.006973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.076782Z","title":"Puterman.Markov Decision Processes: Discrete Stochastic Dynamic Programming","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.076782Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:74667ac90d7e1fbaefbdc32120f9f2256f42f8fc840b8b75896c571ec7084017","observation_id":"ce5a85a2-29a5-436e-b039-69de08bd295f","resolution":{"observed_at":"2026-08-01T15:02:09.076782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.02217","last_updated":"2021-04-28T07:24:49Z","snapshot_observed_at":"2026-08-05T15:08:02.538782Z","submitted_at":"2020-07-16T17:52:37Z","title":"Hopfield Networks is All You Need","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.02217","snapshot_observed_at":"2026-08-01T15:02:09.136169Z","title":"Hopfield networks is all you need, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.136169Z"},"links":{"cited_paper":"/paper/2008.02217","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:6ab8fdccd3dcb8beebcd3651d70c915a4e7036089b8d0147d88ab72954030fc1","observation_id":"cd3c98ed-e35a-43e1-b6a5-f08151da5aae","resolution":{"observed_at":"2026-08-01T15:02:09.136169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.218368Z","title":"Graph networks as learnable physics engines for inference and control","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.218368Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:47e0bdb1548d776f67c9491e41f0aeadd1fb61cc36e92b64c8e12051a8408690","observation_id":"9edd9547-3fac-45e2-be9d-574496b522ba","resolution":{"observed_at":"2026-08-01T15:02:09.218368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.287298Z","title":"Mastering Atari, Go, chess and shogi by planning with a learned model.Nature, 588:604–609, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.287298Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:4a5694453618698d108e426e5c57775cb8bb0760cd107c2655851c39020140d3","observation_id":"ac27f4c3-5c54-43a9-801a-857e34f1ff64","resolution":{"observed_at":"2026-08-01T15:02:09.287298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-09T23:04:15.431743Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-01T15:02:09.336271Z","title":"High- dimensional continuous control using generalized advantage estimation, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.336271Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:bf452a7c0f1261c438ab6ff323bd9dde321a4c63157796fb24a75e47b9af866c","observation_id":"6b0b7c34-eba7-403b-9b54-8390918c4124","resolution":{"observed_at":"2026-08-01T15:02:09.336271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.394919Z","title":"Convolutional LSTM network: A machine learning approach for pre- cipitation nowcasting","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.394919Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:b4cf6a443c6a27edfe6c9a8a7161570510b385509b389abb3bd697f852bedeac","observation_id":"bf603cd5-7c34-4adb-af4c-6f0ea007a2c7","resolution":{"observed_at":"2026-08-01T15:02:09.394919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.474318Z","title":"Mastering the game of Go without human knowledge.Nature, 550(7676):354–359,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.474318Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:1cc49f43daa853703aa1fbe776ada852a0a1de11b721a1953b1b0234417af6db","observation_id":"9ebfd173-a3ee-426f-a151-d7e6ecc25506","resolution":{"observed_at":"2026-08-01T15:02:09.474318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.615278Z","title":"Stachenfeld, Matthew M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.615278Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:f717ead7016e960af860834e9d5820dd06e8fcc4146c55498c3b6c7a74294560","observation_id":"153f4473-7cae-4ddd-a47c-295c64da6971","resolution":{"observed_at":"2026-08-01T15:02:09.615278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.683089Z","title":null,"venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.683089Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:25bbee6f2b476ecb4a5e6c1c1cb9d32087923b5dd12325020fd29dbaae28832f","observation_id":"7426db5f-acd1-4232-b5e2-2e942bee1e69","resolution":{"observed_at":"2026-08-01T15:02:09.683089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.766727Z","title":"Sutton and Andrew G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.766727Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:aefe76fa104a813ce6f64b5a0495cc7cbb9db1c7eca15ca04ba95a2ea2bb81d2","observation_id":"0c6ce0aa-c901-4507-8cae-3d0ea4318df8","resolution":{"observed_at":"2026-08-01T15:02:09.766727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.547129Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.547129Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:c8b19c045471c7376144345b402b5067d0789f4d551d1b6873ec47ce61ea7683","observation_id":"20b2035b-40d6-4146-b760-48eb02093e87","resolution":{"observed_at":"2026-08-01T15:02:09.547129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.878998Z","title":"Planning in a recurrent neural network that plays Sokoban,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.878998Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:af3b6338ed97f5833b017b5012ce681168b665a6dfa31176182d919b1e03c234","observation_id":"7772a4fc-a757-49ac-bcc4-5dbddaaccfeb","resolution":{"observed_at":"2026-08-01T15:02:09.878998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:10.036252Z","title":"Path channels and plan extension kernels: A mechanistic description of planning in a Sokoban RNN","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:10.036252Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:14179dbb8bd163918229e2f94afd94bbe3aa2c37b954cbcbcc36055bc7089732","observation_id":"bd602923-92c8-4cd6-92f7-a79a6cd34349","resolution":{"observed_at":"2026-08-01T15:02:10.036252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:10.088740Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:10.088740Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:052b9181c5b7c6cd0bec018d4dfc95391c1f9b7980a217a721ea18fd9590a08d","observation_id":"db1077a8-e2d7-49f4-a838-744d92e3954c","resolution":{"observed_at":"2026-08-01T15:02:10.088740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:09.824297Z","title":"Sutton, David McAllester, Satinder Singh, and Yishay Mansour","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.824297Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:d7cadd021f826a4084422754041408e3d560d3f676ce70963ece84fbb226d006","observation_id":"95a08ea6-0310-4a8f-9221-8dfeafe319c4","resolution":{"observed_at":"2026-08-01T15:02:09.824297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.01830","last_updated":"2018-06-28T14:59:32Z","snapshot_observed_at":"2026-08-09T19:51:45.796628Z","submitted_at":"2018-06-05T17:39:12Z","title":"Relational Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.01830","snapshot_observed_at":"2026-08-01T15:02:10.268300Z","title":"thinking","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:10.268300Z"},"links":{"cited_paper":"/paper/1806.01830","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:0124f170e8d3cabd3fdaa30dcff7484b727d56bc82586261dad0fd73892b3dcb","observation_id":"b25fdc25-e292-4093-b69e-82f660107eeb","resolution":{"observed_at":"2026-08-01T15:02:10.268300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:10.199082Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:10.199082Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:9c54151e0ad5d60ee7f069fd691fb446bb1c3fe15d334d9d0140538e6aeb36d3","observation_id":"501173ea-6396-4676-8443-578983c9e80c","resolution":{"observed_at":"2026-08-01T15:02:10.199082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:08.857631Z","title":"URL https://proceedings.mlr.press/v120/lambert20a","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":770,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.857631Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:60cd7ff2d16fae449266ddb10a30eb3a3d94e568595c8df2805919ad476c72fd","observation_id":"5eb28650-6644-43d2-b345-51c3ab44724b","resolution":{"observed_at":"2026-08-01T15:02:08.857631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:10.141206Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":1948,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:10.141206Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:3f5721a166f4fdea95962f22d4b3c8b46a2c7c30fb95f069590c82a4b44c29c4","observation_id":"68313b1b-94db-4319-b0d4-28ef8993c0eb","resolution":{"observed_at":"2026-08-01T15:02:10.141206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:08.291294Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:08.291294Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:dafb611fbb82ba86d19775d797a38ea0e926989acefdab2e3e3b3e1d36e3f8c2","observation_id":"e1600f04-ab11-4765-8a3a-72b140fb7e4c","resolution":{"observed_at":"2026-08-01T15:02:08.291294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:02:07.489269Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:07.489269Z"},"links":{"citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:7c7302991f25a6636cf1ab1bc2e348e5354d53b1318ff0e16e298236b95c3e0d","observation_id":"5950a635-ce08-4ff7-b107-71c8205766f9","resolution":{"observed_at":"2026-08-01T15:02:07.489269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15421","last_updated":"2025-05-30T00:08:56Z","snapshot_observed_at":"2026-08-08T06:45:42.034627Z","submitted_at":"2024-07-22T06:57:34Z","title":"Planning in a recurrent neural network that plays Sokoban","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15421","snapshot_observed_at":"2026-08-01T15:02:09.968163Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T15:02:09.968163Z"},"links":{"cited_paper":"/paper/2407.15421","citing_paper":"/paper/2607.18589"},"observation_digest":"sha256:de381efbf8d6974be3f303b5a1ffc9d16341aa5cb9d5c4e12dbae2da5a24071a","observation_id":"a902f4d8-9798-4d43-8998-298549eba040","resolution":{"observed_at":"2026-08-01T15:02:09.968163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18589","last_updated":"2026-07-20T23:49:42Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T18:47:59.779732Z","submitted_at":"2026-07-20T23:49:42Z","title":"Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2607.18589."}