Pith. sign in

Paper Citation Record · LEDGER

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning

As of 9 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2607.23726.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2607.23726 v1

Coverage vector

measured 27 of 27 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-07-30T14:49:29.225582Z

measured 27 of 27 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

27 of 27 outbound references displayed

  • verified exact7
  • verified fuzzy0
  • unresolved16
  • parse uncertain0
  • malformed identifier4
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation de6624ef-83b6-4868-b8e7-69758832922e · outbound

This paper cites doi: 10.3389/frobt.2025.1567211.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning doi: 10.3389/frobt.2025.1567211

Reference 3

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:28.975703Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:28.975703Z digest=sha256:fda0c510d399d870f6e31b9bf155a250523f256214399ac56dc5180d8d469d4a

Observation 2ee8f3fd-2c78-4d56-9063-4e3ead66ba83 · outbound

This paper cites ISBN 978-981-97-5035-1.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning ISBN 978-981-97-5035-1

Reference 7

Resolution
verified exact
doi, observed 2026-07-30T14:50:53.366090Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-07-30T14:49:29.074750Z digest=sha256:822d93fbd8150e738a7e1033aa7ffe6f05b7ae9287741a4e6c581a46e4b68fec

Observation e540d67b-2188-418b-b546-5bc8c3045a16 · outbound

This paper cites Off-policy Maximum Entropy Reinforcement Learning : Soft Actor-Critic with Advantage Weighted Mixture Policy(SAC-AWMP).

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Off-policy Maximum Entropy Reinforcement Learning : Soft Actor-Critic with Advantage Weighted Mixture Policy(SAC-AWMP)

Reference 10

Resolution
malformed identifier
no resolver link, observed 2026-07-30T14:49:29.131546Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.131546Z digest=sha256:63f211a85d71278a281941d96cfb9a3cd3ac4d2123fd5b2a429a96b74a4e788f

Observation e82ab8b3-acef-4e7a-a1df-96add91289d3 · outbound

This paper cites Learning Multi-Level Hierarchies with Hindsight.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Learning Multi-Level Hierarchies with Hindsight

Reference 15

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:29.163862Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.163862Z digest=sha256:0b29924d0361e2037852984f5bb28040ed0d5db78d22abef2daf5b7ff9ac6a33

Observation 3f2ec826-c1a8-4a9a-a0ef-73a03fbc7537 · outbound

This paper cites Chao Lv, Ming Zhu, Xiao Guo, Jiajun Ou, and Wenjie Lou.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Chao Lv, Ming Zhu, Xiao Guo, Jiajun Ou, and Wenjie Lou

Reference 16

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:29.168343Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.168343Z digest=sha256:5277f7659cfd43dae35d04e415a3839664e572fdaf0f278c197f5f28e26cf398

Observation 1498600a-6106-42e9-a1c1-082cc01dc09d · outbound

This paper cites doi: https://doi.org/10.1016/j.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning doi: https://doi.org/10.1016/j

Reference 17

Resolution
malformed identifier
no resolver link, observed 2026-07-30T14:49:29.172612Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.172612Z digest=sha256:fec72f9d76d9f442ff90e1cb53408baadac9a14738c6e3cfc7660ad933dfa4cc

Observation af259677-0dc2-4111-a467-f297a97dc073 · outbound

This paper cites Andrew Y Ng, Daishi Harada, and Stuart Russell.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Andrew Y Ng, Daishi Harada, and Stuart Russell

Reference 18

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:29.176253Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.176253Z digest=sha256:e302a3f49521b6246b8de0646d4a502ca482cf0b2933849a13752685c3ac36dc

Observation b60851a7-cd1b-4d9c-ba1a-f7ce0bdcb7a2 · outbound

This paper cites RescuedBy.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning RescuedBy

Reference 19

Resolution
verified exact
doi, observed 2026-07-30T14:50:53.144310Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-07-30T14:49:29.183389Z digest=sha256:4d5f5462d04ff9fda82818dec6399f9b1fe7b4799dfb6574bd59f8df4a3aabf9

Observation 74e21419-114d-420c-a697-2603ef0fcf6c · outbound

This paper cites Version 1, 1980 images, CC BY 4.0, Accessed: February 12,.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Version 1, 1980 images, CC BY 4.0, Accessed: February 12,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:29.188910Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.188910Z digest=sha256:a6ef58b93a410725ce90cea76d37d970761d93fc2831d3993e886b898b920ba9

Observation 5632b7b4-5eb9-45d5-8fb9-2c118d360f47 · outbound

This paper cites Proximal Policy Optimization Algorithms.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Proximal Policy Optimization Algorithms

Reference 21

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:29.193226Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.193226Z digest=sha256:5dfa5144d14ed27fe18476b10ebb8deb0d4bfd5b3bfbd33165589613c044606c

Observation b806cbc4-3d3e-48fd-8e0c-7d7bd88721ff · outbound

This paper cites Richard S Sutton, Doina Precup, and Satinder Singh.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Richard S Sutton, Doina Precup, and Satinder Singh

Reference 22

Resolution
verified exact
doi, observed 2026-07-30T14:50:53.017794Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-07-30T14:49:29.198475Z digest=sha256:b0e359c47b8ca2b45feaa7a49d6e7807da2f48410be8135e647594baf4b13b04

Observation 492dc1b7-eeac-4f43-8489-29515e4f5cef · outbound

This paper cites SHIRO: Soft Hierarchical Reinforcement Learning.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning SHIRO: Soft Hierarchical Reinforcement Learning

Reference 24

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:29.207423Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.207423Z digest=sha256:b36a259fb8ce50b4c1d6d41db3f847cfc4632907e397c9c963053b0625046997

Observation b060fd3a-194b-4d3a-b24f-fe91dfb76067 · outbound

This paper cites Jiarui Yang, Bin Zhu, Jingjing Chen, and Yu-Gang Jiang.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Jiarui Yang, Bin Zhu, Jingjing Chen, and Yu-Gang Jiang

Reference 26

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:29.216684Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.216684Z digest=sha256:8cd72316d2ef3ddd527f95a67993508675bcc84cb2754a0fef356b5071e91cf4

Observation f990ca5e-e7de-4e09-a792-0958609e7e83 · outbound

This paper cites 48550/arXiv.2508.11143.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning 48550/arXiv.2508.11143

Reference 27

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:29.220989Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.220989Z digest=sha256:cf51ec3aa80714e5ecee502b3e34eddb5917bf01348ed232a91de779435e2fdf

Observation b0df5e0c-38d5-42ca-a02e-0e8bdbc2495f · outbound

This paper cites an unresolved cited work.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Unresolved cited work

Reference 28

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:29.225582Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.225582Z digest=sha256:d8c78325462d61980686d28cf1f2bd60b9347c50f1a445b8a84bbb014d08447b

Observation 8f024449-3b0e-4c6c-a2d0-9c05ccb418a1 · outbound

This paper cites URLhttps://doi.org/10.1016/S0004-3702(99) 00052-1.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning URLhttps://doi.org/10.1016/S0004-3702(99) 00052-1

Reference 1999

Resolution
verified exact
doi, observed 2026-07-30T14:50:52.824752Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-07-30T14:49:29.203473Z digest=sha256:54a2d2b6f5ba766eefb2ac4404a6ee7e3e33f70825050bc6218be707d7980114

Observation f1e540b0-6f2c-4286-9aea-4d72b2420d3d · outbound

This paper cites Botao Dong, Longyang Huang, Ning Pang, Hongtian Chen, and Weidong Zhang.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Botao Dong, Longyang Huang, Ning Pang, Hongtian Chen, and Weidong Zhang

Reference 2000

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:29.113814Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.113814Z digest=sha256:c015eb5c110a6c081276c4710a8a232e4564935cf9caf5fb55b6ec8a23942216

Observation 5a5e4796-f0dc-4f98-ba3f-bd888bf8ed04 · outbound

This paper cites Mohammad Al Homsi, Maja Trumi´ c, Adriano Fagiolini, and Giansalvo Cirrincione.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Mohammad Al Homsi, Maja Trumi´ c, Adriano Fagiolini, and Giansalvo Cirrincione

Reference 2015

Resolution
malformed identifier
doi_truncated, observed 2026-07-30T14:50:53.473403Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-07-30T14:49:28.970720Z digest=sha256:cafa3019ee2632509103227760e97f0544c921f8fea9579e7aeee1683f7b3ade

Observation baac3ab8-4536-4ff0-a891-14085507671b · outbound

This paper cites Michael Laskin, Aravind Srinivas, and Pieter Abbeel.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Michael Laskin, Aravind Srinivas, and Pieter Abbeel

Reference 2016

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:29.153847Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.153847Z digest=sha256:0577e3c53490a11bd592c7a870f239c3100963656d1999056768bac23207fea9

Observation d1b7c7fb-ee14-4065-b7e3-98477741ef57 · outbound

This paper cites Large-Scale Study of Curiosity-Driven Learning.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Large-Scale Study of Curiosity-Driven Learning

Reference 2017

Resolution
malformed identifier
no resolver link, observed 2026-07-30T14:49:28.994745Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:28.994745Z digest=sha256:5753dc295192107c4f640e8b3a5f8b6405a753e4de2a12c7728ce3fe1a257bff

Observation b6abb979-3707-465b-b990-17cf6a5d0515 · outbound

This paper cites Large-Scale Study of Curiosity-Driven Learning.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Large-Scale Study of Curiosity-Driven Learning

Reference 2018

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:29.035790Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.035790Z digest=sha256:bb93a492393567faa8e889c26693c55293aee77cd63dca45c0d750a51bced29c

Observation 1a40db98-bb95-44ea-b329-24d0d2ff932c · outbound

This paper cites Off-policy Maximum Entropy Reinforcement Learning : Soft Actor-Critic with Advantage Weighted Mixture Policy(SAC-AWMP).

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Off-policy Maximum Entropy Reinforcement Learning : Soft Actor-Critic with Advantage Weighted Mixture Policy(SAC-AWMP)

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:29.137552Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.137552Z digest=sha256:f3de710b470b99ad6fed5f08032df0a9eb7118657872a5ce1fb2eff5167a8b74

Observation 71793d86-e21e-4908-943f-7c122a9fed3b · outbound

This paper cites 24 Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Pierre-Luc Bacon, Jean Harb, and Doina Precup.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning 24 Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Pierre-Luc Bacon, Jean Harb, and Doina Precup

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:28.980244Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:28.980244Z digest=sha256:af95a30d5f191bd52e26857bc100af063b578823049d1bbc4eea44a4fdd0b22d

Observation 9ee3656f-18f9-4e4b-aa52-c9ed85da9786 · outbound

This paper cites doi: 10.3390/make4010009.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning doi: 10.3390/make4010009

Reference 2022

Resolution
verified exact
doi, observed 2026-07-30T14:50:53.235189Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-07-30T14:49:29.146078Z digest=sha256:1b2b1205559e8954a161cd368830e09b2babfcac1dc2b9ab64bb75c2eaf26298

Observation 982eef5a-619f-43ad-bdaa-0262b4c8fe08 · outbound

This paper cites Jiangyue Yan, Biao Luo, and Xiaodong Xu.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Jiangyue Yan, Biao Luo, and Xiaodong Xu

Reference 2023

Resolution
verified exact
doi, observed 2026-07-30T14:50:52.684655Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-07-30T14:49:29.212740Z digest=sha256:535c9384dc2921f05ba76d8c477d341ae488ec63ea864c30fb97e4653610ea17

Observation 9dbd8e67-502b-4cb4-845f-4da8c81c8a7a · outbound

This paper cites Nikolas Gegenava.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Nikolas Gegenava

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-07-30T14:49:29.124761Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-30T14:49:29.124761Z digest=sha256:e6f06baf6a21ae2ea1c1dc1ceef71e20dd75081e79540f54080d0dd704bb079e

Observation fee421ed-faa5-4ca6-9f17-76f81655ad7f · outbound

This paper cites Mostafa Al-Emran.

Hierarchical Soft Actor-Critic for Sparse-Reward Long-Horizon Reinforcement Learning Mostafa Al-Emran

Reference 2025

Resolution
verified exact
doi, observed 2026-07-30T14:50:53.638804Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-07-30T14:49:28.964206Z digest=sha256:f9a672887c8102d35ca904e6cb6b1805dd426a48367c32b774f6022a7ea1d27c

Pith citing papers

No inbound Pith citation observations are available.