{"as_of":"2026-08-11T07:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2a6dc5247911a83abc9b54b6dabcf8b61b2b1db810ba9162f8b9ba768d8ff982","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:59:01.602504Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.04373/citation-record","integrity":"/paper/2507.04373/integrity","json":"/paper/2507.04373/citation-record.json","paper":"/paper/2507.04373"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:05.991600Z","title":"For” loop, it records a trajectory τj. The “While","venue":null,"work_id":"7021b4f5-cd59-4b6d-84d8-d2575c4e00b0","year":2017},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:58:59.566592Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:ecc3468f8fbdda33b9bb8a6c5acfeef0cd0fad1db27710007540d53d32bd53c9","observation_id":"bcd355d3-c603-4b23-a5b9-f8a40174012e","resolution":{"observed_at":"2026-08-06T19:59:06.021733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:05.893919Z","title":"As we mentioned earlier, q1 is the upper bound on the expected number of the nodes that are ancestors of the node n","venue":null,"work_id":"a50b778b-435f-4e6e-8004-47682d1fce96","year":2017},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:58:59.618392Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:993348ea39a6535e1df771354153c0c9f988801f0135d37f8e3ad339b748113c","observation_id":"95ea9249-855c-411c-a23e-662050c6afee","resolution":{"observed_at":"2026-08-06T19:59:05.944378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:05.404407Z","title":"At this point, we have constructed Ijr","venue":null,"work_id":"fc97b214-2f08-497d-94e3-b7dbe7230492","year":1984},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:58:59.825900Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:4bfb0248451c1aebb7d4b4b207e1007811bfbe4ddfd6284c358eb35e29a6ed31","observation_id":"69954592-9938-4d56-bf2e-2c8dc644aadb","resolution":{"observed_at":"2026-08-06T19:59:05.518464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:03.968651Z","title":null,"venue":null,"work_id":"762831ce-ab43-4903-995a-4ad9358c3aa8","year":2019},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:00.670188Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:ecca74d3570de28e8cefb764801a72c483126c10ded597350d1d0f03da603446","observation_id":"3c607cc7-9191-47d2-aed3-1feccd0c5f42","resolution":{"observed_at":"2026-08-06T19:59:04.057351Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:05.763718Z","title":null,"venue":null,"work_id":"afa9ec4b-89ed-40b5-af4f-cada07b6d6dc","year":null},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:58:59.661189Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:866fd7496c9dab0b646e0856425f23daf83d03450207d375d9b089149667e061","observation_id":"edde5922-6480-4b98-ab29-786f37d13290","resolution":{"observed_at":"2026-08-06T19:59:05.828947Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:05.620915Z","title":null,"venue":null,"work_id":"4ede5461-c0e1-4131-b19c-00161f0530f1","year":null},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:58:59.724253Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:a9be6fd26e82346d166324e0fffe522ce9270428993e033bf5130764420a4031","observation_id":"42e29f81-69a3-43a8-b12a-03053e05786f","resolution":{"observed_at":"2026-08-06T19:59:05.693361Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:05.114440Z","title":"We define a function parent pointer : Φ → Φ, which assigns the corresponding parent of a node gi","venue":null,"work_id":"107f2d2c-1bdc-4364-9fe0-f5e345b7ddfc","year":null},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:58:59.911931Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:0e50a61bee5b209bdb340bfdac9fb5041f7b6ecf00ad54c67ef8a20af4f2ecea","observation_id":"fa4077de-a00f-4075-9185-2e15929efd7f","resolution":{"observed_at":"2026-08-06T19:59:05.217088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:04.926200Z","title":"• If gi is the goal, backtrack to construct the path","venue":null,"work_id":"f6a814f2-5935-4d08-820b-fa04fbf56f41","year":null},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:00.025603Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:794a49d88ef2969847e387c45e46f31cbc7bf1e0b2b2d45c820e8b8a9b148777","observation_id":"9e8f781a-6a32-4a70-8290-de481f5cb137","resolution":{"observed_at":"2026-08-06T19:59:04.993906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:04.739150Z","title":null,"venue":null,"work_id":"e6c497d0-40f2-4f9b-8804-8505c9411ab3","year":null},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:00.125185Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:999baced9e2c3b3a4d83b686440a0003a1a6c9de1653c5edf41b9ed94bed852d","observation_id":"0fdd8088-47d8-400b-8192-c94b8819f64e","resolution":{"observed_at":"2026-08-06T19:59:04.830033Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:04.564977Z","title":"We define a function parent pointer : Φ → Φ, which assigns the corresponding parent of a node gi","venue":null,"work_id":"a7fae7bf-1fae-40a5-abf3-143cf3f30a23","year":null},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:00.267033Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:c31e5f07b3533548cc19b3dfcadd245c37b6592744c22275b6baf74be26fd3db","observation_id":"1d7564ee-af70-4be3-a534-1afc40a97600","resolution":{"observed_at":"2026-08-06T19:59:04.636736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:04.363506Z","title":null,"venue":null,"work_id":"316be4ba-6b3d-4a66-b17e-06b76ddacf7d","year":null},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:00.396920Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:9c71a493d15830d80dfa5f4cfb8ec10774753ba7aa8633521cfd7cd26fdf7676","observation_id":"85b7b82b-c5fa-4cc4-a2ce-39d18e44cbd0","resolution":{"observed_at":"2026-08-06T19:59:04.475273Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:04.177287Z","title":"– For each neighbor gv of gu in ˆGt: * Set w(gu, gv) = |C HˆGt gu \\ back track(gu)| + 1","venue":null,"work_id":"10a17e94-7eeb-4741-899c-14a43f91e182","year":null},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:00.547872Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:6892ab05effe8806c7fd55dd9439771857d60602a536a73ed6ec91be156f9548","observation_id":"6a16f74e-6055-4dfa-af95-128e97919592","resolution":{"observed_at":"2026-08-06T19:59:04.279653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:03.573325Z","title":"This implies that in all possible assignments, at least one parent of gi is always 1","venue":null,"work_id":"992e3bf9-21af-4809-a94f-38071f97be4b","year":null},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:00.788274Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:949aa8f042def111d22ed1783dde35057a68c3ea9d4812d8a491f5ac9df355c3","observation_id":"8eb58f2e-b6e1-4739-badf-4d54b33deb9d","resolution":{"observed_at":"2026-08-06T19:59:03.743170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:03.244835Z","title":"This means that in the collected data, if Xj is one, at least of some other parent Xk is also one","venue":null,"work_id":"69ebcc5a-181e-4efe-b67b-d25630d2cd2c","year":null},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:00.909216Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:84b9280e9f6b28f0a7c7b388cea1c844885e73508f679061db9ae0b788e7d7d9","observation_id":"a35dfc16-e6ec-4fd6-b17a-0a9593aa35ec","resolution":{"observed_at":"2026-08-06T19:59:03.450693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:02.998498Z","title":"Thus, the AND operator equals to 0: θi(Xt) = ^ gj ∈PAgi X t j = 0","venue":null,"work_id":"347c3b61-cbd7-4076-a9ad-41dd9e018854","year":null},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:01.009013Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:f5db7aa9df181af9b65bb872154215ddcd70933de717be549923aab10d1f773a","observation_id":"d5db77dc-54b7-4b3e-bc67-5d6e4c1cdc69","resolution":{"observed_at":"2026-08-06T19:59:03.115544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:02.741253Z","title":"This means that if Xj is zero, at least of some other parent Xk is one","venue":null,"work_id":"7aa5d324-e251-499c-bb22-b866392a140e","year":null},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:01.140753Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:a36ebca76d5969ed5d52a37dfe57d1ad0b0a8fd3aefb787281984eb54ab4eeb7","observation_id":"a059b745-1826-4392-b327-b64a4db82a01","resolution":{"observed_at":"2026-08-06T19:59:02.908195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:02.499197Z","title":null,"venue":null,"work_id":"58cddc60-3e3e-4f19-9faf-75cdd1eeb60b","year":null},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:01.268863Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:dc47f07b1adb115166e00fe000aa462ea80fd01ee06638e4f9e581288c2a517d","observation_id":"5cc87883-af28-4119-a045-0c75be5b4e8f","resolution":{"observed_at":"2026-08-06T19:59:02.610404Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:02.257486Z","title":null,"venue":null,"work_id":"07f81414-67cc-4fa1-9a82-05bba7986661","year":null},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:01.396496Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:cbb9c7e6478fc5e1ff2d39ae1bf7b40951e42ec07be48cfddcb7d9d68fd9eebe","observation_id":"8419e1d6-20e4-4c15-b4a2-176bb38a79d9","resolution":{"observed_at":"2026-08-06T19:59:02.369210Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:02.034947Z","title":null,"venue":null,"work_id":"c7312223-e77d-41dd-b095-62d6016a96c3","year":null},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:01.490528Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:2ae08391f9ebac103f74e4da579e7cb73175cf83ab9507a850359f4868f837de","observation_id":"6bfd4648-1748-4764-9424-c2d5a7829dae","resolution":{"observed_at":"2026-08-06T19:59:02.158132Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:59:01.777360Z","title":"oracle goal space","venue":null,"work_id":"e1f4f747-178f-4a14-8261-0df84ee65dff","year":2022},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:01.602504Z"},"links":{"citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:3195c7f0e2d11799637b619565d248b7ba2c61b14871cf4b7eb4c9a2d7f0072e","observation_id":"c33044bd-59e3-4cb9-aa43-89263fdf337d","resolution":{"observed_at":"2026-08-06T19:59:01.882505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.13440","last_updated":"2019-07-29T18:10:30Z","snapshot_observed_at":"2026-08-10T19:41:28.414659Z","submitted_at":"2019-07-29T18:10:30Z","title":"MineRL: A Large-Scale Dataset of Minecraft Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.13440","snapshot_observed_at":"2026-08-06T19:58:59.435876Z","title":"Forestier, S., Portelas, R., Mollard, Y ., and Oudeyer, P.- Y","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":1528,"source":"pdf_text","source_observed_at":"2026-08-06T19:58:59.435876Z"},"links":{"cited_paper":"/paper/1907.13440","citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:98a2da1e14415987a22001559de78a936b78b95592f86c6df8c60bddc4a2680e","observation_id":"69459973-4e23-4b37-8620-6369ffb101a3","resolution":{"observed_at":"2026-08-06T19:58:59.435876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01075","last_updated":"2020-08-23T04:23:05Z","snapshot_observed_at":"2026-08-07T05:19:25.809438Z","submitted_at":"2019-10-02T16:50:15Z","title":"Learning Neural Causal Models from Unknown Interventions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01075","snapshot_observed_at":"2026-08-06T19:58:59.513260Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions","version":1},"reference_index":3119,"source":"pdf_text","source_observed_at":"2026-08-06T19:58:59.513260Z"},"links":{"cited_paper":"/paper/1910.01075","citing_paper":"/paper/2507.04373"},"observation_digest":"sha256:0c4908a2ae392e560db777429254bec374e2b8edf95dc98a0ba700498a3cbeab","observation_id":"9faebd17-940c-4b85-a192-68f2b8d61b45","resolution":{"observed_at":"2026-08-06T19:58:59.513260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.04373","last_updated":"2025-07-06T12:38:42Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T05:00:29.701638Z","submitted_at":"2025-07-06T12:38:42Z","title":"Hierarchical Reinforcement Learning with Targeted Causal Interventions"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":2,"unresolved":8,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2507.04373."}