{"as_of":"2026-08-12T21:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f32227441dc0c2929fa0d736f22f971940385d43735e7fd5864b4509cd10239c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":2,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":2,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T22:15:08.324750Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T05:47:21.235081Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.03342","last_updated":"2024-09-08T11:22:48Z","snapshot_observed_at":"2026-08-09T01:05:01.502708Z","submitted_at":"2023-10-05T06:49:52Z","title":"LESSON: Learning to Integrate Exploration Strategies for Reinforcement Learning via an Option Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03342","snapshot_observed_at":"2026-08-11T22:15:08.324750Z","title":"Lesson: learning to integrate exploration strategies for reinforcement learning via an option framework","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03767","last_updated":"2024-12-04T23:12:41Z","snapshot_observed_at":"2026-08-12T09:34:12.100457Z","submitted_at":"2024-12-04T23:12:41Z","title":"Hyper: Hyperparameter Robust Efficient Exploration in Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T22:15:08.324750Z"},"links":{"cited_paper":"/paper/2310.03342","citing_paper":"/paper/2412.03767"},"observation_digest":"sha256:e3768f4aa8dc9ae37901a2c80dccc4fe202f4cac123d0a1a94e0776018dce981","observation_id":"71e915c1-a226-46d4-aed6-19f27206c9ca","resolution":{"observed_at":"2026-08-11T22:15:08.324750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03342","last_updated":"2024-09-08T11:22:48Z","snapshot_observed_at":"2026-08-09T01:05:01.502708Z","submitted_at":"2023-10-05T06:49:52Z","title":"LESSON: Learning to Integrate Exploration Strategies for Reinforcement Learning via an Option Framework","version":2},"cited_work":{"arxiv_id":"2310.03342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.03342","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d055a927-17e8-40c5-9429-8a0829672793","year":2023},"citing_paper":{"arxiv_id":"2605.12261","last_updated":"2026-05-12T15:28:32Z","snapshot_observed_at":"2026-08-11T09:02:53.117616Z","submitted_at":"2026-05-12T15:28:32Z","title":"Delay-Empowered Causal Hierarchical Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T05:46:51.659283Z"},"links":{"cited_paper":"/paper/2310.03342","citing_paper":"/paper/2605.12261"},"observation_digest":"sha256:c5f2ce7f5acf4d0abe0c3ed3f5a04377e682ab694c5d26f2b11a582737b98686","observation_id":"be09baa7-46f2-450c-b63a-929bc80ce150","resolution":{"observed_at":"2026-05-13T05:47:21.236697Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2310.03342/citation-record","integrity":"/paper/2310.03342/integrity","json":"/paper/2310.03342/citation-record.json","paper":"/paper/2310.03342"},"outbound":[],"paper":{"arxiv_id":"2310.03342","last_updated":"2024-09-08T11:22:48Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T01:05:01.502708Z","submitted_at":"2023-10-05T06:49:52Z","title":"LESSON: Learning to Integrate Exploration Strategies for Reinforcement Learning via an Option Framework"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 2 inbound Pith citation observations for arXiv:2310.03342."}