{"as_of":"2026-08-09T15:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d0c352eb2f123c405d0a9b789e0c026c3097d3264f64919442cede9373ff6cb8","coverage":[{"denominator":99,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":99,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T01:38:17.524753Z","state":"measured"},{"denominator":99,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":99,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.28849/citation-record","integrity":"/paper/2607.28849/integrity","json":"/paper/2607.28849/citation-record.json","paper":"/paper/2607.28849"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:04.983680Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:04.983680Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:8c247447b1d62f6de682e66f23001d4480c96e96796edf2061524eb23ae6a286","observation_id":"c28f9b18-bbc3-4277-ad60-06600159a845","resolution":{"observed_at":"2026-08-03T01:38:04.983680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:05.069083Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:05.069083Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:cbb579dc9c0c95bba7ef215f1024a4c2cd6261b3580398a2de3219a1c5e39280","observation_id":"49fb158f-ee80-471f-8117-556f09c45514","resolution":{"observed_at":"2026-08-03T01:38:05.069083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:05.180446Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:05.180446Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:6e85422335882b00c7e464a808dd07d87c7e18bc42e667903a4464bd1e71bacd","observation_id":"49ef8a6c-115d-4e69-a887-f8a1c003e1c0","resolution":{"observed_at":"2026-08-03T01:38:05.180446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:05.336812Z","title":"Transactions of the American Mathematical Society , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:05.336812Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:00c3588aa79013a989c8b0df22a5527254534768d7eef46150789dc1a351b247","observation_id":"1ab8b205-260b-4ed4-b472-e92aeb857194","resolution":{"observed_at":"2026-08-03T01:38:05.336812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:05.441225Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:05.441225Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:061f617c6333f881ad02b2ab8ba914a71fb06f03ea39d2df9dcb0495d607a443","observation_id":"c637d383-b70c-40d8-8fd3-0a76d616d16b","resolution":{"observed_at":"2026-08-03T01:38:05.441225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:05.531438Z","title":"ACM Computing Surveys , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:05.531438Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:5da26871b1644c25d20eea12a23de389d9843e25b9f0c933419cad4a2dab35cc","observation_id":"6a96938b-8d7a-442d-b9be-8c311b60e7a4","resolution":{"observed_at":"2026-08-03T01:38:05.531438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:05.537609Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:05.537609Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:e06fe209b0fe9b4060f947166c31d7a6e5d6c5001ce6b5bf32833019c1bcc592","observation_id":"88a255fe-c820-4126-a8e9-c3a2c24fd8bf","resolution":{"observed_at":"2026-08-03T01:38:05.537609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:05.640440Z","title":"Discrete event dynamic systems , volume=","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:05.640440Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:baf717f120a23c5804f76bdcc9bc1b145d1397b27f9565a60bc448c4ff1f1dad","observation_id":"57ccfd05-f3d6-49ff-b6c9-8ab3838f382d","resolution":{"observed_at":"2026-08-03T01:38:05.640440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:05.748091Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , author=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:05.748091Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:25d7b2307aba15338732a2d7ab712fa8b15aceb7359744cb7b4bf9195fe50bf1","observation_id":"e73ffb67-6baa-4052-b152-07752b99b9e7","resolution":{"observed_at":"2026-08-03T01:38:05.748091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:05.852582Z","title":"Proceedings of The 25th International Conference on Artificial Intelligence and Statistics , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:05.852582Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:a63173cfe9406b1bb57002370ab474625b793c221b0091c763b30fcbb8c982b7","observation_id":"81225104-755b-4bce-ae65-84556bb6ef70","resolution":{"observed_at":"2026-08-03T01:38:05.852582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:05.986598Z","title":"The Annals of Statistics , volume=","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:05.986598Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:b46dc7f7b425bf5a52e8070f9e0331c7c944485ce600a580d89a520403cf1d48","observation_id":"a3c28d24-487b-49bc-998e-3cee22d07373","resolution":{"observed_at":"2026-08-03T01:38:05.986598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:06.188028Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:06.188028Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:9af5a3dcebce62aced3388a4b0164c6c31223da397ab03af81245d3b26a27fbd","observation_id":"1535ffaa-49e8-4e3a-91c8-b7f42d595259","resolution":{"observed_at":"2026-08-03T01:38:06.188028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:06.319759Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:06.319759Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:5c6345042af1e07ed4c18ce8f3d708f42c9b46638ee50cacd1f6581cab12be3f","observation_id":"d27635a8-52a8-472e-b27c-207734a50213","resolution":{"observed_at":"2026-08-03T01:38:06.319759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:06.409452Z","title":"SIAM Journal on Optimization , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:06.409452Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:df20c92d3dce6dd509b3b46b84b58015b9dc1659aef9cf82f145dca4746c3b91","observation_id":"5eafe6ca-e609-4f41-9f17-67ebcc8040bd","resolution":{"observed_at":"2026-08-03T01:38:06.409452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:06.575637Z","title":"The Thirty-ninth Annual Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:06.575637Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:4e3a1e3ac4fd283bbeab10319eeee33757ed8ef999c2849d8759ef6083b160a8","observation_id":"48d24ec4-5bc0-4ec7-958f-fb3f699ed043","resolution":{"observed_at":"2026-08-03T01:38:06.575637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:06.744793Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:06.744793Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:d0fc3803dce7a2f1218c704a6634a7fff727f36947059c4e10add7dc04369d59","observation_id":"837a4e77-0e6e-4d74-ade3-34d630dd3c0b","resolution":{"observed_at":"2026-08-03T01:38:06.744793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:06.919694Z","title":"International Conference on Artificial Intelligence and Statistics , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:06.919694Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:523f1ae981619fb56501c6cea3a92bdc3e335d2a89cbae8c6dad5bb46230443c","observation_id":"732215e2-5213-49cf-beb7-551289a4ba7a","resolution":{"observed_at":"2026-08-03T01:38:06.919694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:07.123010Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:07.123010Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:316b80e3ef6b8a596d68a26fcde7160995694e149a09a88778cddeeccba6b4bc","observation_id":"bf0f806b-80d3-4371-96a6-b5be1b7e882b","resolution":{"observed_at":"2026-08-03T01:38:07.123010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:07.296665Z","title":"Achieving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:07.296665Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:cda914953808ea675959579e5c24c33e6f35f870f2146fcd6be72e0a7edbf41a","observation_id":"8f08e37c-7f78-4730-8623-6ca9c5be4f6c","resolution":{"observed_at":"2026-08-03T01:38:07.296665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:07.470619Z","title":"The Thirty Seventh Annual Conference on Learning Theory , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:07.470619Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:ddca266bbf0d108b6bed5cd61a8abb7bab3a7563f8c8db26fc4b1b82555f778c","observation_id":"ab0dd64c-2172-43df-a944-ae67a172d696","resolution":{"observed_at":"2026-08-03T01:38:07.470619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:07.585904Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:07.585904Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:f93a8805a79e32fc62e491b9246287a64ba00dd71d9efd3093a6baa6b778fa47","observation_id":"5ea8b51f-a70a-41bc-8d1b-6fc94a62ac27","resolution":{"observed_at":"2026-08-03T01:38:07.585904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:07.722810Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:07.722810Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:4e43098e6cb6201a154223155c5a6241ae0fe6916a2505998830a3cdfea981f6","observation_id":"af5b95e7-653e-4d94-a557-d8694868e209","resolution":{"observed_at":"2026-08-03T01:38:07.722810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:07.909600Z","title":"International Conference on Artificial Intelligence and Statistics , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:07.909600Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:46e98547b81382836c6750bbb72b9d7db1a6360db9f84880aa7aec1e974872fc","observation_id":"0693f69b-c049-4711-81ab-0d0c59a768f3","resolution":{"observed_at":"2026-08-03T01:38:07.909600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:08.061723Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:08.061723Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:536ab43b1ec0e310ed060185c44eac13669f967e3cc8db126edca6e1e1d3f5e8","observation_id":"f6d16884-8312-4054-88b6-9cca8c3b9044","resolution":{"observed_at":"2026-08-03T01:38:08.061723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:08.371099Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:08.371099Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:3f54fac82d029db6056a13c69135b4c18f9c982335818d689273867009dfc9b8","observation_id":"08757f36-08e7-4b28-a2a2-a2dc298820e5","resolution":{"observed_at":"2026-08-03T01:38:08.371099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:08.526342Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:08.526342Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:cd2faaeb4e46e0ae7373369a11bf7897a82f215953f59633a76aad8e5f7f742b","observation_id":"09b136e8-5a20-4752-92ed-6a0b8e66baf7","resolution":{"observed_at":"2026-08-03T01:38:08.526342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:08.681330Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:08.681330Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:0aaf00854bc299f524038a2dbe1755539024f258c53d2940c30733051a448179","observation_id":"7af85630-865e-4f6f-ae42-1697ccf35208","resolution":{"observed_at":"2026-08-03T01:38:08.681330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:08.852503Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:08.852503Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:df93e534b96a24e2d8f9b79a3b8cbacaae6a147f1db15fa5dc1f0f0f51000baa","observation_id":"964167ea-9a96-4eab-a80a-438c8b7f8c8b","resolution":{"observed_at":"2026-08-03T01:38:08.852503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:09.015756Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:09.015756Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:ae5377208f8024a18d2e82780429ff5137b08ef46002aa02d8b2b77f4ff8cb27","observation_id":"b485b2b1-4be4-400f-8782-a06e9f4758d5","resolution":{"observed_at":"2026-08-03T01:38:09.015756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:09.194011Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:09.194011Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:d50aa6fcbeeaf4d53449bdd67cbbdac3da4d1f8a4b5b71569c87dcf6d66ddd66","observation_id":"186d857c-ad96-4350-b245-4c2c41a12a1a","resolution":{"observed_at":"2026-08-03T01:38:09.194011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:09.371976Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:09.371976Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:5ca32efaea2e6169f7b156f8502d2e725e3d357676d2b8b488aff2dbe93b521b","observation_id":"8c7ab054-43b0-4803-bf8d-dc14ac0e8936","resolution":{"observed_at":"2026-08-03T01:38:09.371976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:09.719811Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:09.719811Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:266995f9d4d26b899b1cba27c7427a2ea13657c4bd046e0a7d1d13c527a2ccab","observation_id":"a3e092d5-ee07-4d3d-8cc0-ab33bce62574","resolution":{"observed_at":"2026-08-03T01:38:09.719811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:09.915422Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:09.915422Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:f2119b7b1fb86229b52d1273579985c96d2e966f39d7f4e897b07be03c14a1c8","observation_id":"f670da16-86a0-4b33-83ba-721ea174dea8","resolution":{"observed_at":"2026-08-03T01:38:09.915422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.01123","last_updated":"2022-06-08T16:36:24Z","snapshot_observed_at":"2026-07-06T12:43:17.428867Z","submitted_at":"2022-03-01T18:20:01Z","title":"A Primal-Dual Approach to Bilevel Optimization with Multiple Inner Minima","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.01123","snapshot_observed_at":"2026-08-03T01:38:10.112895Z","title":"arXiv preprint arXiv:2203.01123 , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:10.112895Z"},"links":{"cited_paper":"/paper/2203.01123","citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:019f00819ea2cdf9441fd980bfe13d953ea11fdf865bc4fb13d812be38bf3709","observation_id":"35db6e36-4bb4-4fa1-a5bb-f64797bf50a1","resolution":{"observed_at":"2026-08-03T01:38:10.112895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:10.328062Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:10.328062Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:28349de56059d1984678231f47d99d726b25c41e98b50326198e422dd0a435d3","observation_id":"60113249-390b-4d88-9f70-62adf99e31e4","resolution":{"observed_at":"2026-08-03T01:38:10.328062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16164","last_updated":"2024-01-29T13:50:56Z","snapshot_observed_at":"2026-07-06T17:21:51.054477Z","submitted_at":"2024-01-29T13:50:56Z","title":"Constrained Bi-Level Optimization: Proximal Lagrangian Value function Approach and Hessian-free Algorithm","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16164","snapshot_observed_at":"2026-08-03T01:38:10.550633Z","title":"arXiv preprint arXiv:2401.16164 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:10.550633Z"},"links":{"cited_paper":"/paper/2401.16164","citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:106f8365f818f45a5370e9864152b9accf72c3d0060deaf45cb72e5946257d12","observation_id":"3098a4ee-8670-40f8-8dbd-da1fccb9bee1","resolution":{"observed_at":"2026-08-03T01:38:10.550633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:10.719704Z","title":"International Conference on Artificial Intelligence and Statistics , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:10.719704Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:eefb7cc10428bf85f260745ea512cc5317ef061b41abecf5b81e0196bf718223","observation_id":"609fe3e8-a3a6-4064-9fca-f3cad2a6d322","resolution":{"observed_at":"2026-08-03T01:38:10.719704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10148","last_updated":"2024-08-26T01:08:49Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T15:59:36Z","title":"A Primal-Dual-Assisted Penalty Approach to Bilevel Optimization with Coupled Constraints","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10148","snapshot_observed_at":"2026-08-03T01:38:10.892564Z","title":"arXiv preprint arXiv:2406.10148 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:10.892564Z"},"links":{"cited_paper":"/paper/2406.10148","citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:729d49864a0570c71c79f81cc7a94bb81469905bd5f1495860d01cece2c4b764","observation_id":"5488a5ea-ae64-4ef2-bdc5-665c3d1181ee","resolution":{"observed_at":"2026-08-03T01:38:10.892564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01992","last_updated":"2024-06-04T06:22:04Z","snapshot_observed_at":"2026-08-06T15:55:37.131724Z","submitted_at":"2024-06-04T06:22:04Z","title":"Overcoming Lower-Level Constraints in Bilevel Optimization: A Novel Approach with Regularized Gap Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01992","snapshot_observed_at":"2026-08-03T01:38:11.039361Z","title":"arXiv preprint arXiv:2406.01992 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:11.039361Z"},"links":{"cited_paper":"/paper/2406.01992","citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:a414dc7132075051b308109ebc964b40e1824f1a15b221041d3b6c856cb586a7","observation_id":"60dbdb57-9856-44df-9558-af99d04b24e2","resolution":{"observed_at":"2026-08-03T01:38:11.039361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:11.159317Z","title":"ICASSP 2022-2022 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:11.159317Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:85408f5b362666da8bf1527ce00700355178fed3d131125fe7ef70294723e862","observation_id":"741bff12-a885-441b-8db1-eba0c5ca921a","resolution":{"observed_at":"2026-08-03T01:38:11.159317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:11.345028Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:11.345028Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:5de61f351b9660a9843a8f3407bf3f248f647799f055d493be5f1bb6ce88f117","observation_id":"6ffa621c-4e94-41b8-af86-ad0f694fe813","resolution":{"observed_at":"2026-08-03T01:38:11.345028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:11.479219Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:11.479219Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:e77b9d665c510ebc14789a1e5e80e835941c5591ecbeffeb009bf28a9e9ea1bc","observation_id":"a71d71ed-70b8-40b0-af22-9e7bc2c2483d","resolution":{"observed_at":"2026-08-03T01:38:11.479219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.16761","last_updated":"2024-01-20T16:41:48Z","snapshot_observed_at":"2026-08-09T04:53:44.768191Z","submitted_at":"2023-06-29T07:57:47Z","title":"Moreau Envelope Based Difference-of-weakly-Convex Reformulation and Algorithm for Bilevel Programs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.16761","snapshot_observed_at":"2026-08-03T01:38:11.581927Z","title":"arXiv preprint arXiv:2306.16761 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:11.581927Z"},"links":{"cited_paper":"/paper/2306.16761","citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:00086dfd0de11ab960dfadc2f92bebaeae79a4594e3a46799cfef53efb592260","observation_id":"b9047e26-5b17-49fa-9a3d-1778c3dcc3cf","resolution":{"observed_at":"2026-08-03T01:38:11.581927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:11.676775Z","title":"The 41st Conference on Uncertainty in Artificial Intelligence , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:11.676775Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:591bbd9967ad5e2173edb0ba28787a68ff885d5ae996f2cffc411ba3b7993811","observation_id":"2138561e-7247-4079-8953-06405e56133e","resolution":{"observed_at":"2026-08-03T01:38:11.676775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:11.849269Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:11.849269Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:1dd0b40f6d995f6ac9fee61b3301e5ee0faa0503c0c4d5ae0b275fcc34ebfff4","observation_id":"5e40740b-555d-4e6e-b8ae-c03b42f3f7ac","resolution":{"observed_at":"2026-08-03T01:38:11.849269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:11.967535Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:11.967535Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:30b319514bccbbdaabd20ba77a704b8d44be04143b0e023968fa332b8ce965cc","observation_id":"cb6f2930-7796-4432-9f07-b00068a59b26","resolution":{"observed_at":"2026-08-03T01:38:11.967535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:12.095784Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:12.095784Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:c08f58415f39030d0ad3dc4cecb9e9aa2b18dcbf9c7a6a8dab00d23ec59b81b4","observation_id":"f7d9bbd5-10a9-4254-a140-b13d162286a9","resolution":{"observed_at":"2026-08-03T01:38:12.095784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:12.243346Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:12.243346Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:c0c475f455840c73c97555c0fc4d87455976c06906d5a791e6e6946321d010f5","observation_id":"b09a1365-b114-40fc-8905-a5a353e7f649","resolution":{"observed_at":"2026-08-03T01:38:12.243346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:12.427776Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:12.427776Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:9f734a2bcfb7ea330d4a520ec308f458758e9806316f66192060747eeb966bcf","observation_id":"d582b873-ef11-469f-8dc3-f2dd9c01c648","resolution":{"observed_at":"2026-08-03T01:38:12.427776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:12.545732Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:12.545732Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:a02ceef7352f37e9ce9c9185cbffbc546cfbb6909fc4c4e65e6c0f763a293478","observation_id":"5ed50b1d-b9f2-4c2a-972d-514f2aff04d5","resolution":{"observed_at":"2026-08-03T01:38:12.545732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:12.659802Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:12.659802Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:2a9a0add900c057e5cf5d11a7370962ee1065feb9701e2f1ebe7c4e6136726a9","observation_id":"fd4d0336-27a4-4edc-b12c-f63e3c48264d","resolution":{"observed_at":"2026-08-03T01:38:12.659802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:12.710646Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:12.710646Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:6a61079c7f34e14a33f5f624cd96b5b8a3a581683356c385fad24e69a57bf589","observation_id":"8d5d77f6-a0f8-4f30-ad90-c39de05054f8","resolution":{"observed_at":"2026-08-03T01:38:12.710646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:12.786066Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:12.786066Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:1682a6c315c596c93b42e440338af9827de0b977627f86bbcbccc85ea3f9ae95","observation_id":"8c51a27f-23b9-4fbc-b077-3b787a275c63","resolution":{"observed_at":"2026-08-03T01:38:12.786066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:12.896743Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:12.896743Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:3078f7e868412376589c7bc199550d868f72f201c845472e370d4f870e2c42ae","observation_id":"d544a1a1-2cef-4a0e-b75d-1e21dc148dfc","resolution":{"observed_at":"2026-08-03T01:38:12.896743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:13.028560Z","title":"Proximit","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:13.028560Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:d2c730e01e852047121ef7d376e0aba6a6da683aec8d9e557ec3e93a8d159cc1","observation_id":"6867598f-3099-4a6e-9a93-67b5083f9df5","resolution":{"observed_at":"2026-08-03T01:38:13.028560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:13.271739Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:13.271739Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:056c0c4cca22eb7d3b1dcf601427e75c62fb0f7d77bd2a7963f3d029beffbb21","observation_id":"712e6e42-a804-4177-9f35-d9962d08bfc1","resolution":{"observed_at":"2026-08-03T01:38:13.271739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:13.426999Z","title":"Stochastic subgradient method converges at the rate O (k^","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:13.426999Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:f1febcc8beb4a694145690351b3c71cf05f4edd9870cf5a9555067433c57c1be","observation_id":"a5820e00-2ec8-47fc-8ca9-5bf222dea30a","resolution":{"observed_at":"2026-08-03T01:38:13.426999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:13.531338Z","title":"1998 , publisher=","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:13.531338Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:a4219c1adca18d8f49cddfbe84c2abeb36a8cf361d8bce46b88b89478df8d45d","observation_id":"93ebc01c-ce6a-4537-873a-0739c978e5c2","resolution":{"observed_at":"2026-08-03T01:38:13.531338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:13.605734Z","title":"Linear convergence of gradient and proximal-gradient methods under the polyak-","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:13.605734Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:e17eeb06a8763e8543c3593de8a1c88fbd74a0fba7c92c09e483a0876910144d","observation_id":"59bde824-0e8c-4cb7-8b12-86e7ecf6ad6a","resolution":{"observed_at":"2026-08-03T01:38:13.605734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:13.773082Z","title":"Journal of optimization theory and applications , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:13.773082Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:5784acd29d7988b8bb64276bf86288e649f75832b1071e5db7699b01e5081568","observation_id":"9fb91b90-fe22-47e1-b85f-0a8e7d5b3086","resolution":{"observed_at":"2026-08-03T01:38:13.773082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:13.853872Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:13.853872Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:cc7956165ae33a0d3a4e69beecb042795223c5230962812dcedf4a0b6a69b9df","observation_id":"c056d98d-c618-4cc8-873a-a723fb634635","resolution":{"observed_at":"2026-08-03T01:38:13.853872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:13.920858Z","title":"the method of paired comparisons , author=","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:13.920858Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:83816c793db9aba47d7f7329a4d0d4bb80c18c121af466ff389db3558c2194a7","observation_id":"58139e5a-04a2-48af-826c-9d09242ba63f","resolution":{"observed_at":"2026-08-03T01:38:13.920858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:14.008895Z","title":"International conference on artificial intelligence and statistics , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:14.008895Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:d5300e72824315f10af5a74d1ef7385947894ad7283d4c5d40901bfb0daded93","observation_id":"46c1542f-40df-47f6-bb2a-115aa7383695","resolution":{"observed_at":"2026-08-03T01:38:14.008895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:14.134298Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:14.134298Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:19ab70f6390a97ef74c333d23cd9d99b2ea51394399f3749e09980b507b43d07","observation_id":"7a3a2cfb-c80f-481c-a4b0-8aa9e50de831","resolution":{"observed_at":"2026-08-03T01:38:14.134298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:14.542969Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:14.542969Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:da33ecb09c80e81950c2440bc42800a43045bebd8a2a3652fe2c0e751df93df9","observation_id":"054208e8-a618-4d8f-9e86-6974a13aeeb1","resolution":{"observed_at":"2026-08-03T01:38:14.542969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:14.625606Z","title":null,"venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:14.625606Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:87622bc83adc0e880cc97921aabaa15afdcd7a8efecc4afb7a5c51b4491b46f7","observation_id":"9b405480-a436-43e7-aeae-1aa8e4e9405e","resolution":{"observed_at":"2026-08-03T01:38:14.625606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:14.679588Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:14.679588Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:0adbbe3a467dbf49d8e0d4baee4ce16702209756ad6f03d2bb597f6acdddb575","observation_id":"9569b531-52a1-415d-8947-edff58f71abe","resolution":{"observed_at":"2026-08-03T01:38:14.679588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:14.776723Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:14.776723Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:91226d4509fd4d02d4d5214250aa30017e1a71bf3e6264458dad38b2b7321e77","observation_id":"280f8ce0-bc32-4436-b5eb-1a34e2b35c4b","resolution":{"observed_at":"2026-08-03T01:38:14.776723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:14.867203Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:14.867203Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:f0937ef6c7627617f6f48ce401552e280d75ca1cefcaa51797d42b12090e3408","observation_id":"ad0deca7-af27-4be3-917e-68b43fb6a1f1","resolution":{"observed_at":"2026-08-03T01:38:14.867203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:14.952155Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:14.952155Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:e03512ab26319ff1cd9af8ba13d317259b79b5929c6c7364b7cdf837a3fefd2d","observation_id":"4854c676-f930-4be6-9102-640ecdc9a6b0","resolution":{"observed_at":"2026-08-03T01:38:14.952155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:15.037266Z","title":"and Zhao, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:15.037266Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:93891ea403bb5f2013868a1804c0cdd1aa43138663c5831139c037f0209de373","observation_id":"c1491627-caf0-4f02-956a-8d8b9c2634ce","resolution":{"observed_at":"2026-08-03T01:38:15.037266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:15.111843Z","title":"F., Leike, J., Brown, T., Martic, M., Legg, S., and Amodei, D","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:15.111843Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:7e7b7e0e686868bbf5ee3a371e318941a4c887edada7d527bb8e0c111fd47250","observation_id":"bbd99c33-baaa-42d9-8b19-597a626c16ca","resolution":{"observed_at":"2026-08-03T01:38:15.111843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:15.171698Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:15.171698Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:838edfa8dd7299a1ce8a9652cd2ef567ac6a5f3a6e9c7e5053b99c1b28a0633d","observation_id":"722ec001-36bb-4bb2-a63c-61d61ce91454","resolution":{"observed_at":"2026-08-03T01:38:15.171698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:15.328055Z","title":"U., and Aggarwal, V","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:15.328055Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:0b06ec19c9667b6cc73dbb336be812e1e1f080d904936520bc20536d39f38e52","observation_id":"228788f7-1672-48d9-9eaa-313353ff86bc","resolution":{"observed_at":"2026-08-03T01:38:15.328055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:15.397070Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:15.397070Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:4d02be72973b420c4fc80cc4be888b752dbdf9abe8c428b74b9838af2af3ef20","observation_id":"92106f54-6fc8-488d-adc8-186dd6a38d5b","resolution":{"observed_at":"2026-08-03T01:38:15.397070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:15.461194Z","title":"S., Pasupathy, R., and Aggarwal, V","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:15.461194Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:f14c20f0bcacd9fccc9702654231e147da2928b441ebabfa6f1d61aa546eadcd","observation_id":"4d235133-44a4-492a-8263-4e8054939c74","resolution":{"observed_at":"2026-08-03T01:38:15.461194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.02246","last_updated":"2018-02-06T22:10:14Z","snapshot_observed_at":"2026-07-06T06:22:08.261855Z","submitted_at":"2018-02-06T22:10:14Z","title":"Approximation Methods for Bilevel Programming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.02246","snapshot_observed_at":"2026-08-03T01:38:15.537353Z","title":"and Wang, M","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:15.537353Z"},"links":{"cited_paper":"/paper/1802.02246","citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:33b60060e05f81c8c4ac1dd7bf07ecdb39008c377e24525ce876ea52decf46e2","observation_id":"f6359638-8bc2-4283-93ab-9d30d441396d","resolution":{"observed_at":"2026-08-03T01:38:15.537353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:15.614105Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:15.614105Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:57aa4d9dddd3584e8567c8123262192b3fe9327ca6c908b0c38679e5c060e5e9","observation_id":"1aeb9dc2-2752-44fd-94ad-272ed2980abe","resolution":{"observed_at":"2026-08-03T01:38:15.614105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:15.713752Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:15.713752Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:c37440f008cbded4bb8965522425c25f64644ffa8e5fbf677d5a8f6a49e84627","observation_id":"a141b86a-829a-4fbf-a8ba-b8239a62a818","resolution":{"observed_at":"2026-08-03T01:38:15.713752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:15.791091Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:15.791091Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:7be52e02edf627fbb6cb96399554917638a2fb2826507190df9c9cd6eefd5927","observation_id":"f64caa87-99e4-4fb8-899a-07141cb840ae","resolution":{"observed_at":"2026-08-03T01:38:15.791091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:15.883588Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:15.883588Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:f146fdf76ac27137da486034c6c14017a7ec986d225e8a4c26eb71601e3259c2","observation_id":"78cce6ce-b1e3-4e0e-8b08-7c38d46759b3","resolution":{"observed_at":"2026-08-03T01:38:15.883588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:15.959960Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:15.959960Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:41d865293be5bc6560f22ac1aa9134dc8fa3faba3c0ce6063c490abd9639a8fc","observation_id":"4c57dba8-c0ee-4e8c-b92a-8ab38eeda842","resolution":{"observed_at":"2026-08-03T01:38:15.959960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:16.041306Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:16.041306Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:3136d3dd125a1527c02e3f8952beb014edb619d5e689ef11908f4901d3432a8c","observation_id":"cce51860-4769-4bb1-925a-e5c072201367","resolution":{"observed_at":"2026-08-03T01:38:16.041306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:16.152427Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:16.152427Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:ed98b83b119f8c362fe99b8b02043f01f6e5f26104ed30565a70b318cdee7bb7","observation_id":"ddcb0d4f-ec5a-451e-89d2-75d07b83707f","resolution":{"observed_at":"2026-08-03T01:38:16.152427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:16.235023Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:16.235023Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:78489ab6772caf30270fad1e6429f32cb26d43d791739b88373e95596c8903a4","observation_id":"5ae78788-d5a7-4f2f-b1f5-1e31c6b27bc7","resolution":{"observed_at":"2026-08-03T01:38:16.235023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:16.345052Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:16.345052Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:24ef65998ae003633fc1b8c197e89f4e2cd803e2dc674deecd51711d70b71d7e","observation_id":"c69bfb1e-2001-483a-890d-2b3a2925b72a","resolution":{"observed_at":"2026-08-03T01:38:16.345052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:16.421015Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:16.421015Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:0238bb3e02cd4132c850f80b7ebffaa7d5bcade496174032ae18535500ce8c33","observation_id":"ec1e3bf9-ebb8-4f5e-b112-3a37a542c0fe","resolution":{"observed_at":"2026-08-03T01:38:16.421015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:16.494178Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:16.494178Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:3859360828e40eb157bff436d7600a1c94fc9bbdb4a3749fbabcf4a07462658c","observation_id":"105e5df8-ca7e-43d5-b6c8-991002da3fc2","resolution":{"observed_at":"2026-08-03T01:38:16.494178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:16.534166Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:16.534166Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:644891e0aa499a874a25d5681222e82829f0f0f0c9d4e94c54e5d594c2b6b2d7","observation_id":"13dac79f-7ed7-4e63-86a5-5b0bcd25bcbf","resolution":{"observed_at":"2026-08-03T01:38:16.534166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:16.631772Z","title":"and Chen, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:16.631772Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:0d6b7abbe8682edfeddd3c26edbcef21378d31b186dd6edbcf6903c19223be46","observation_id":"25989173-818e-49a8-b151-3a8ee13715d5","resolution":{"observed_at":"2026-08-03T01:38:16.631772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:16.704747Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:16.704747Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:a4b953e10543c83aa4755c816ee66a71239bdb8e73e561642e01094947edd6ed","observation_id":"d14f801c-87b0-435e-ad01-83881b226b90","resolution":{"observed_at":"2026-08-03T01:38:16.704747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:16.795656Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:16.795656Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:7e6e91b33ec0cc12ccc001693c426b47edef656c56be6d027ff3795a832861d0","observation_id":"573909b5-ea75-4f1b-a462-004c991d45c8","resolution":{"observed_at":"2026-08-03T01:38:16.795656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:16.863877Z","title":"S., McAllester, D., Singh, S., and Mansour, Y","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:16.863877Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:717d08f8c4107b1be5eaec7641294a3d8aa33a5724d23ffffa4e7be10dde532a","observation_id":"12a2a072-c57a-4d5c-89eb-610f52327b6b","resolution":{"observed_at":"2026-08-03T01:38:16.863877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00690","last_updated":"2018-01-02T15:48:14Z","snapshot_observed_at":"2026-08-01T20:24:08.300098Z","submitted_at":"2018-01-02T15:48:14Z","title":"DeepMind Control Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.00690","snapshot_observed_at":"2026-08-03T01:38:16.949810Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:16.949810Z"},"links":{"cited_paper":"/paper/1801.00690","citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:0ea5e5eec4969397a37123d7aec1de6e3d6eb5b07cb92ea95503b36770c36fac","observation_id":"12ad3002-aee7-4be9-b01b-cb9883898372","resolution":{"observed_at":"2026-08-03T01:38:16.949810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:17.044732Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:17.044732Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:bfb854eb1f3e1838158be7f9a5ffafe407e4c54990974d20b25ae04f45ba3ace","observation_id":"bd0e87f5-868a-45dc-b0c5-423d451e6a74","resolution":{"observed_at":"2026-08-03T01:38:17.044732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:17.144361Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:17.144361Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:82833958f1b8c6f35b371a0b6ed276445ebf4f0ce3736a1a47930c7a808f2746","observation_id":"237b557c-785d-4530-ace0-62394a202820","resolution":{"observed_at":"2026-08-03T01:38:17.144361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:17.240498Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:17.240498Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:4d53a1962b0841608edf8dcf0666020fca71801fde97a79e1177a4dda0b2f3cf","observation_id":"da5ec1d8-06ec-4223-af14-d739e5193a9d","resolution":{"observed_at":"2026-08-03T01:38:17.240498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:17.414751Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:17.414751Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:346586dfc2374ee741e0315622dd08211ec6966c22a060c5b254c459e31e4df6","observation_id":"b5b352b3-f7fe-42c9-8e96-81c73ade5f33","resolution":{"observed_at":"2026-08-03T01:38:17.414751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:38:17.524753Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-03T01:38:17.524753Z"},"links":{"citing_paper":"/paper/2607.28849"},"observation_digest":"sha256:7a0f2ae97d187970613d0b1ef7a56e9149883cf3caa04191b254a194d585e965","observation_id":"c3487aaa-dee0-4ff2-8b7f-4c7aaaabdf05","resolution":{"observed_at":"2026-08-03T01:38:17.524753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.28849","last_updated":"2026-07-30T21:21:52Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T12:39:22.608084Z","submitted_at":"2026-07-30T21:21:52Z","title":"Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity"},"reference_resolution":{"displayed":99,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":99},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 99 of 99 outbound references and 0 inbound Pith citation observations for arXiv:2607.28849."}