{"as_of":"2026-08-09T19:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c9b3a67ef7780482a0f21346fa42249ff9b04b0cf096deb3bc6381114be5b3f8","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T01:37:31.834106Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.26333/citation-record","integrity":"/paper/2606.26333/integrity","json":"/paper/2606.26333/citation-record.json","paper":"/paper/2606.26333"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Analysis of Temporal-Difference Learning with Function Approximation.Advances in Neural Information Processing Systems, 9, 1996","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:0e2385b2f7ca49f441a49a25ef073920febc61307d220205fe367f9ab55a1013","observation_id":"54b9f506-ecbc-46e7-8545-cbbad43a4436","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"MIT Press Cambridge, 1998","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:8f55d72e82d0d0f2997634257f52c21cf4837e0648c8c2f48d2e2916aec281f9","observation_id":"48f076ab-4e66-4c6d-851d-1aa57282735c","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Temporal Difference Learning: Why It Can Be Fast and How It Will Be Faster","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:68756c0854ce6883283a9f83da84acd750188a9966c424b2150b34bd335d69e2","observation_id":"a82dae2d-1272-43de-ab6e-9b75979ff99c","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Prioritized sweeping: Reinforcement learning with less data and less time.Machine Learning, 13(1):103–130, 1993","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:47f4129c114f828ba9158f3de293e3876b0ebe4348b1243b75f4db97dcd6eb6a","observation_id":"afb1d8ac-6fab-412d-b8f9-9b06225dc913","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Reinforcement Learning with Hierarchies of Machines.Ad- vances in Neural Information Processing Systems, 10, 1997","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:97a10303d7adef56cf26c3e31593386965d2d1cee2029bc4796638feeee7d7c2","observation_id":"900da209-a47b-40bb-9e4a-4dde7ae59b28","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Recent Advances in Hierarchical Reinforcement Learning.Discrete Event Dynamic Systems, 13(4):341–379, 2003","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:730dd1595d4fa79c510269c0355066a23cfa8e74ae148b0bbc11ef69f1cb71bc","observation_id":"5b49c0dd-589b-4188-af65-b29e7c4b6528","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Hierarchical Rein- forcement Learning: A Comprehensive Survey.ACM Computing Surveys (CSUR), 54(5):1–35, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:84e389018c612b5163f28cc1fce32c25243e5c6e721fb575832d5aede5d96ec4","observation_id":"d551474c-9a77-4e48-b151-d9779eeede53","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14045","last_updated":"2025-06-16T22:36:32Z","snapshot_observed_at":"2026-08-07T00:16:34.774752Z","submitted_at":"2025-06-16T22:36:32Z","title":"Discovering Temporal Structure: An Overview of Hierarchical Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.14045","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.14045","snapshot_observed_at":"2026-07-04T15:29:55.591686Z","title":"arXiv preprint arXiv:2506.14045 , year=","venue":null,"work_id":"cba277d3-02b1-4978-8b71-b7e000236cfa","year":2025},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"cited_paper":"/paper/2506.14045","citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:433f4874b22998c0b1b881a5997b0e1cc07d547f2369346f6c91916aa630027d","observation_id":"0c356e5a-15f1-45b8-8ce2-d1cb3e97768e","resolution":{"observed_at":"2026-07-04T15:29:55.593473Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Hierarchical Reinforcement Learning with the MAXQ Value Function Decomposition.Journal of Artificial Intelligence Research, 13:227–303, 2000","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:7b77f35de41cc96d704febade9bab7b3ecc9653d08f79b983143b48e34c8afd6","observation_id":"345b09b8-a4db-4910-9d1d-18c2b8b77a20","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Between MDPs and semi-MDPs: A framework for temporal abstraction in reinforcement learning.Artificial Intelligence, 112(1- 2):181–211, 1999","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:e77696c132755030926a80b9a551c7a6a5c2a5c2b28fb3c2c681d807ec4e75eb","observation_id":"9a6f6522-b8fd-4ae7-b45c-17eecba8702a","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Discovery of options via meta-learned subgoals","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:9921d5f5b260bbb89c78fbc48c402a04cadfa9ecf30f4b7e55383249c3ac8df6","observation_id":"d5f27410-837b-4de6-a4e5-657166ec40a4","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Multi-layer abstraction for nested generation of options (mango) in hierarchical reinforcement learning.IFAC-PapersOnLine, 59(26):25–30, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:90cb29f21b438962ae3b0c0c9eb3eba2d1df6973bb19688caf887dad6482b8ca","observation_id":"30553a57-7f88-4db8-b5ec-d7fa2142b581","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Value Iteration Networks.Advances in Neural Information Processing Systems, 29, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:d09aeeca62bba09d1bc2979e6464453538521b3b52553e3d89009b32d4011496","observation_id":"99052512-c3de-4938-9a2e-7ec227edbfc0","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"RUDDER: Return Decomposition for Delayed Rewards","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:e96c5b92bedfe590d7a50a009118b3deb65c259cd0637ad68ab42ee4a03766f6","observation_id":"be005e62-57fc-44ea-937a-069109442a0f","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Successor Features for Transfer in Reinforcement Learning.Advances in Neural Information Processing Systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:93b1177b34cc4eaaf5d5db40baada8e314924c109ce74a6af4ea3a9cbb9ebd48","observation_id":"ffd45b6f-473f-40e7-ab82-39116ebb70a9","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"The Option-Critic Architecture","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:631560a15c7076d0042eb97eef940007497604385a69191f5b68c239e66eac4a","observation_id":"16eaac72-f277-4e59-8d08-5323c324d8dd","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.10995","last_updated":"2021-02-26T21:21:11Z","snapshot_observed_at":"2026-07-06T07:30:05.397042Z","submitted_at":"2019-01-30T18:40:37Z","title":"Go-Explore: a New Approach for Hard-Exploration Problems","version":4},"cited_work":{"arxiv_id":"1901.10995","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1901.10995","snapshot_observed_at":"2026-07-04T15:29:55.587215Z","title":"Go-explore: a new approach for hard-exploration problems","venue":null,"work_id":"811ed60c-dea3-46b6-b28f-bf76eb844c38","year":1901},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"cited_paper":"/paper/1901.10995","citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:0d21b43de538e4e78f66e7ec6ee05036597abb7c7dfcac1b67f1df15541436e8","observation_id":"8b571451-306a-446d-9365-0c52851e27b2","resolution":{"observed_at":"2026-07-04T15:29:55.590065Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Springer Science & Business Media, 2004","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:c846bafb9a21040b8028a1234413a69daac658fdd6a58b8ee081159d6781ae53","observation_id":"bf6f3d2d-b261-4cc2-a726-c777786dc380","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Butterworth- Heinemann Oxford, UK:, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:6e8fe5e08d217428e9c3ec68186eba067b0520a92fe56e9132299e7280d8c6b7","observation_id":"8eb4e794-f4a0-429d-8fe4-1dc3a84807b2","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.09874","last_updated":"2018-04-27T17:55:06Z","snapshot_observed_at":"2026-08-02T11:19:35.648087Z","submitted_at":"2017-11-27T18:46:00Z","title":"Divide-and-Conquer Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1711.09874","doi":null,"metadata_source":"pith","pith_arxiv_id":"1711.09874","snapshot_observed_at":"2026-07-04T15:29:55.609297Z","title":"Divide-and-Conquer Reinforcement Learning","venue":"cs.LG","work_id":"1a1b70e0-19b2-4b7c-9830-027cfd9982b9","year":2017},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"cited_paper":"/paper/1711.09874","citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:fc11a2e80df3c33064242e168048ee555714e5b4c36332ee0218f98cf57fd9f3","observation_id":"4a734384-1404-4f7f-8e03-ae4f26cc5bcd","resolution":{"observed_at":"2026-07-04T15:29:55.611156Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.08997","last_updated":"2017-05-24T23:19:44Z","snapshot_observed_at":"2026-07-06T05:44:11.621822Z","submitted_at":"2017-05-24T23:19:44Z","title":"State Space Decomposition and Subgoal Creation for Transfer in Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1705.08997","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.08997","snapshot_observed_at":"2026-07-04T15:29:55.598232Z","title":"State Space Decomposition and Subgoal Creation for Transfer in Deep Reinforcement Learning","venue":"cs.AI","work_id":"7f93929e-d9f4-4be6-83e4-90a3cc58aaf4","year":2017},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"cited_paper":"/paper/1705.08997","citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:b7480f8e71b2d37dd4a53778c1997d5e7623b0cde05aa157b84fc436114091c0","observation_id":"49bb79e9-d448-47ba-baee-873586f538a7","resolution":{"observed_at":"2026-07-04T15:29:55.600110Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"State-space decomposition for reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:899f114f1b9f79c17d61c6d446782579a2a01f43ae55f1fbaf1f8e4cf285233c","observation_id":"773f1a03-ed0c-4f0a-a1b0-74a8228d4535","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Q-Cut—Dynamic Discovery of Sub-goals in Reinforcement Learning","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:5ca9729497c7c09add1a669add22c7b1d438b3aed198a051f3f582e63ab1119c","observation_id":"c6a8db91-da8a-4640-bb35-faefc48b33ae","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"On the bottleneck concept for options discovery: Theoretical underpinnings and extension in continuous state spaces.Masters thesis, McGill University, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:b91dbbf62a903cbdfd90c516bcf3d0c2e304247d8657f503e8351d8647512d64","observation_id":"c3341425-e41c-470f-8272-27c169bdee05","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"First results with Dyna, an integrated architecture for learning, planning and reacting.Neural Networks for Control, 179, 1990","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:f5b67fdb53100a2a550ac264fc264644cc0caf883e8da616cb983f6242807c01","observation_id":"872c1262-a9a4-4202-81ec-44a7c6d5e320","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Proto-Value Functions: Developmental Reinforcement Learning","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:996f47cfa248d7ccf9f480fb03ad47130ecd6d4cd16c0027b70fa26b625da85e","observation_id":"357537c1-21e5-468c-be37-2aba8622631b","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Policy invariance under reward transforma- tions: Theory and application to reward shaping","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:6e2f393ab8a894f7f9df4747c6cd6c22ace50d6f5d590699f51c9d94db961b82","observation_id":"73a004f0-7298-444f-9874-988d478aef5b","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.09281","last_updated":"2019-11-11T14:18:31Z","snapshot_observed_at":"2026-07-06T08:31:00.030545Z","submitted_at":"2019-10-21T12:06:28Z","title":"Dealing with Sparse Rewards in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1910.09281","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.09281","snapshot_observed_at":"2026-07-04T15:29:55.594907Z","title":"Dealing with sparse rewards in reinforcement learning","venue":null,"work_id":"906de8dd-dca7-4ded-a470-00299b47049d","year":1910},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"cited_paper":"/paper/1910.09281","citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:79544ca76f44dbe58892a324db691d2dcd2694d8f2e7d2f431d10d96c69b5a58","observation_id":"824aeed7-4275-48ab-ba4a-539b19db6c86","resolution":{"observed_at":"2026-07-04T15:29:55.596964Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Reinforcement Learning for Adaptive Mesh Refinement","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:bf4c272fdf73be9f38023393c6e674a260965c2bac3a8cd590d728fd80a8ca4b","observation_id":"d2cfa473-73e4-4de3-a78f-5961b0f9d0b6","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Swarm Reinforcement Learning For Adaptive Mesh Refinement.Advances in Neural Information Processing Systems, 36:73312–73347, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:c9a0403b9ae4d37922eaf54ed086763556c6b5782a082721fdebc6ff6ac44b8a","observation_id":"1c51f50c-b37c-4298-aaaf-7c07320d922f","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Multi-agent reinforcement learning for subgrid-scale modeling of environmental turbulence","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:c485792eb746b231beb009bbb5803ef92eb6ce28a965952d264fb23865fb76ec","observation_id":"248676cc-8692-4bbd-964a-bb6856076830","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14243","last_updated":"2023-09-27T15:43:39Z","snapshot_observed_at":"2026-07-06T16:23:22.439333Z","submitted_at":"2023-09-25T16:03:08Z","title":"Enhancing data efficiency in reinforcement learning: a novel imagination mechanism based on mesh information propagation","version":2},"cited_work":{"arxiv_id":"2309.14243","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14243","snapshot_observed_at":"2026-07-04T15:29:55.601519Z","title":"Enhancing data efficiency in reinforcement learning: a novel imagination mechanism based on mesh information propagation.arXiv preprint arXiv:2309.14243, 2023","venue":null,"work_id":"c74b50e9-4ce8-4401-a0b2-b0e11c1ea886","year":2023},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"cited_paper":"/paper/2309.14243","citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:617df4c8f6b07c63986f5698c0efde12b1d853415cd350a33f3d02606d8498cb","observation_id":"27689123-81d4-41d0-bbc9-854d160a8d71","resolution":{"observed_at":"2026-07-04T15:29:55.603573Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.16761","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T15:29:55.605484Z","title":"arXiv preprint arXiv:2505.16761 , year=","venue":null,"work_id":"ea66371d-6107-49f1-a87a-cffe8402ac89","year":2025},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:c947e62270baec474a7abbb1b5e1129e92c9c191f77a533d04c6cbfaaa3376f6","observation_id":"9623f2d7-51a9-4ff4-bf96-24638003e6ad","resolution":{"observed_at":"2026-07-04T15:29:55.607579Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Courier Corporation, 2003","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:55f8cf3ce3a54ce5c69b450bb41ad812467bb1c2d3157245c5536983e05e6a01","observation_id":"4037c0f8-dd2d-43ca-bd1b-07136f5e5bc6","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Klaus-Jurgen Bathe, 2006","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:5b14c877e84a6a924c481c92ca5e9afd28da9cc855a55d2e8e2960b6ca95c06c","observation_id":"426a2164-7a8c-46f9-b1f0-bad548f73eda","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"McGraw- Hill New York, 2005","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:8076c2b118cdb12cb5ec5ab9440ad143d8bdc573b565936b489a51d098353f95","observation_id":"f4fd38ef-5c62-4f5d-9d2f-e10355b8ddc2","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Parallel domain decomposition software","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:cb77c16f22086a0e8ca787bc9a9bbe208af2182e3d86b3aec388d2e74af49f38","observation_id":"83e426a0-3acc-473d-85b3-1997bace5341","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Learning from delayed rewards.Ph","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:318ee61f17504497346d14ac0d499e549544137ea0ac29c62758470acdbdd4c4","observation_id":"101efb36-fe1c-4d2d-aeac-e6079b93bfe6","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Q-learning.Machine Learning, 8(3):279–292, 1992","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:706cf8e4bce5cca6d331f6e78661e371423983c7b7859056fb542b36f306f99e","observation_id":"63541c50-22f0-411e-8a23-ee117f83d720","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"University of Cambridge, Department of Engineering, Cambridge, UK, 1994","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:559de5229184d71c979a313349eaf7280061d4985ed5fad1d71ff9124ac99a3c","observation_id":"6cb00865-9d9c-4a6a-9522-21a15d0a9e84","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Integrated Modeling and Control Based on Reinforcement Learning and Dynamic Programming.Advances in Neural Information Processing Systems, 3, 1990","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:7a2aa82e93a5ba8a16efc9841c3675b34158a11079a46f955ed4f8379452aefe","observation_id":"239cb133-139b-416d-806d-0831f2a3cc4b","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Schwarz methods over the course of time.Electron","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:d471e58d9589d8bd1e6ac8f3232831754df372e881b72e28e3cbc52617b82f41","observation_id":"ffcd635e-24b5-4aec-9c19-407e0ae8ac17","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:37:31.834106Z","title":"Generalization in Reinforcement Learning: Safely Approxi- mating the Value Function.Advances in Neural Information Processing Systems, 7, 1994","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-26T01:37:31.834106Z"},"links":{"citing_paper":"/paper/2606.26333"},"observation_digest":"sha256:1dccd672e5aef463b146751cc12902459cfbbdc72454680f5091217613daab33","observation_id":"aa8c2f5e-83d2-4266-a3ac-5391c4132da0","resolution":{"observed_at":"2026-06-26T01:37:31.834106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.26333","last_updated":"2026-06-24T19:16:34Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T17:20:16.758054Z","submitted_at":"2026-06-24T19:16:34Z","title":"Mesh-RL: Coupled subgrid reinforcement learning"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":7,"verified_fuzzy":0},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2606.26333."}