{"as_of":"2026-08-11T15:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a4e5a46d06b41a0adcc4ed2ca6dcf17c60c7d1de3d12dafb158c45dafbacfa4b","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T19:03:05.612017Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T04:53:10.425398Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T04:55:54.390079Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2502.05537","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.05537","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sequential stochastic combinatorial optimization using hierarchal reinforcement learning","venue":null,"work_id":"d99f7839-90cf-4cc4-857d-6f672e422e0c","year":2025},"citing_paper":{"arxiv_id":"2510.19544","last_updated":"2026-04-19T17:25:37Z","snapshot_observed_at":"2026-08-11T11:51:18.031718Z","submitted_at":"2025-10-22T12:50:27Z","title":"Demonstrating Real Advantage of Machine-Learning-Enhanced Monte Carlo for Combinatorial Optimization","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-18T04:53:10.425398Z"},"links":{"cited_paper":"/paper/2502.05537","citing_paper":"/paper/2510.19544"},"observation_digest":"sha256:3af7ced762bb3cd6b39b517899660978c219794dd95122eff0d9571f259a6407","observation_id":"2a5b9ce3-0b75-478c-b9e1-ec527baf48a4","resolution":{"observed_at":"2026-05-18T04:55:54.392627Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.05537/citation-record","integrity":"/paper/2502.05537/integrity","json":"/paper/2502.05537/citation-record.json","paper":"/paper/2502.05537"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.536756Z","title":"Hindsight experience replay","venue":null,"work_id":"e4da1e98-be53-4848-8d64-dfffcf174f87","year":2017},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.324922Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:c41846cc5d11c45194720d94c3abc6a9bcc9e261a3025179ed498bd5497e7f57","observation_id":"c6c77021-e3ee-4112-b584-715da3499ddf","resolution":{"observed_at":"2026-08-08T19:03:06.542013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.329854Z","title":"Modern graph neural networks do worse than classical greedy algorithms in solving combinatorial optimization problems like maximum independent set","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.329854Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:4673aef55ba764edcc5568a956817dac0f58af706aeb63e7029b5c9b0d4e276c","observation_id":"80bc2e2b-6d14-497d-bdfc-a089e43c1f27","resolution":{"observed_at":"2026-08-08T19:03:05.329854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.510848Z","title":"The option-critic architecture","venue":null,"work_id":"2dadf7df-f508-4d48-bc05-a3b4b483ada2","year":2017},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.335054Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:fde5ab4fb37cdf3346c1351cb0aba6303717f68c016497d3cd12a24b0266a254","observation_id":"a3983750-a7ef-4efb-baee-21a3f9c5dd32","resolution":{"observed_at":"2026-08-08T19:03:06.515774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.09940","last_updated":"2017-01-12T23:55:36Z","snapshot_observed_at":"2026-07-06T05:20:39.825511Z","submitted_at":"2016-11-29T23:22:39Z","title":"Neural Combinatorial Optimization with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.09940","snapshot_observed_at":"2026-08-08T19:03:05.340426Z","title":"Neural combina- torial optimization with reinforcement learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.340426Z"},"links":{"cited_paper":"/paper/1611.09940","citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:0793eddbc3e0f4c80506d4979f3e35867229cb9d2c4f5960d9c884b3502069fe","observation_id":"1a98aa2a-c9a5-4ac4-81ab-4cc5cad97071","resolution":{"observed_at":"2026-08-08T19:03:05.340426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.494445Z","title":"Machine learning for combinatorial optimization: A methodological tour d’horizon","venue":null,"work_id":"58680cd9-bdb0-44f8-bc30-6a207c1c6dd9","year":2020},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.345801Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:28642933d3fcc009b04e23a37b2437cde2820b3874d03d0235a5ae56a73ad30f","observation_id":"346bc664-227d-4ce3-a8de-a8a07546b3b2","resolution":{"observed_at":"2026-08-08T19:03:06.499738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17100","last_updated":"2025-07-21T08:23:56Z","snapshot_observed_at":"2026-07-06T15:48:25.059865Z","submitted_at":"2023-06-29T16:57:22Z","title":"RL4CO: an Extensive Reinforcement Learning for Combinatorial Optimization Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17100","snapshot_observed_at":"2026-08-08T19:03:05.351089Z","title":"Rl4co: an extensive reinforcement learning for combina- torial optimization benchmark","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.351089Z"},"links":{"cited_paper":"/paper/2306.17100","citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:bc590cc893d3401d4a4d3c4637f9678d4cf57cb38695a670a044af830a99ad5f","observation_id":"fc86a519-a3bf-44ae-8b0b-2c73b28e54d1","resolution":{"observed_at":"2026-08-08T19:03:05.351089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.478620Z","title":"Models and algorithms for combinatorial optimization problems arising in railway applications","venue":null,"work_id":"aff63873-e309-4bbf-b363-a1714188c9e2","year":2009},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.356856Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:9eba6b392e2dd899d5ea9bcbd045893efb084e3f6a8692a84fd4a69e23e4094e","observation_id":"fb027c3d-feae-4b3b-9fa6-fc9845017877","resolution":{"observed_at":"2026-08-08T19:03:06.483727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.464134Z","title":"Applying gis and combinatorial optimization to fiber deployment plans","venue":null,"work_id":"36364fb7-13a6-47e8-a79f-2630778eab30","year":1999},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.361449Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:6b5a68bdd234e4bdf187171694a57d440d5ce1ee6c3c338d720184e097b4fcd4","observation_id":"ee40282e-4239-4fe5-9e56-a68597b703dc","resolution":{"observed_at":"2026-08-08T19:03:06.468790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.449527Z","title":"Improving optimization bounds using machine learning: Decision diagrams meet deep reinforcement learning","venue":null,"work_id":"2ffffb07-b2be-4aeb-a6f5-6b3f04859c25","year":2019},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.366486Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:edad636893cc04cab91e3416bf23480f095a9fa83f79abfecba0c5edae8ea7ac","observation_id":"521f4a51-8597-44ec-81a6-908180e21947","resolution":{"observed_at":"2026-08-08T19:03:06.454089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.435114Z","title":"Contingency-aware influence maximization: A reinforcement learning approach","venue":null,"work_id":"0a78150c-bd09-4c9d-82e1-b336da5377f0","year":2021},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.371644Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:95c25df8d2e1d30c2f8592727d18f8be0d14dbb81cffc5654cd707d9bb419b88","observation_id":"3954d364-95aa-4a94-964d-af507c0c7b21","resolution":{"observed_at":"2026-08-08T19:03:06.439691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.419549Z","title":"Learning to perform local rewriting for combinatorial optimization","venue":null,"work_id":"5ae396e7-6602-44a8-8f3b-c2a270017f98","year":2019},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.376450Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:aa12f338da619dcaed7d6f0f1c26b6a260391bffc35643dd2afe2eef0751e2c8","observation_id":"6be00938-74af-433d-9b9f-c98995bc0d09","resolution":{"observed_at":"2026-08-08T19:03:06.424938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.404146Z","title":"Discriminative embeddings of latent variable models for structured data","venue":null,"work_id":"bdbba4e8-cb31-4911-b7b3-f0f5e36e0190","year":2016},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.381049Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:136f07428de6023751369137e67b50959b6da1b5b80ad00b8213e0964a2f203a","observation_id":"405cfe16-e1c0-4ae7-a095-5ad040e51962","resolution":{"observed_at":"2026-08-08T19:03:06.409130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.389015Z","title":"Feudal reinforcement learning","venue":null,"work_id":"26c8c988-aec8-4366-b7e8-6f6219146988","year":1992},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.385410Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:ce4719f2d5635bffa74394270d374c5fef06231b0476cf302ee27157175bee66","observation_id":"41e48dd5-391d-42c7-af87-dc38750570eb","resolution":{"observed_at":"2026-08-08T19:03:06.394011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.372582Z","title":"Learning heuristics for the tsp by policy gradient","venue":null,"work_id":"e1c49930-faae-4ff9-bfab-c0fb6b8424a6","year":2018},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.389827Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:8da1b8bb33c681d6f64e589892ce7bad920e52a1f40ff3eb1a1cdb2257464d1e","observation_id":"44c5ad8f-c132-4ef7-a2f7-b547bc87892f","resolution":{"observed_at":"2026-08-08T19:03:06.377570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.07010","last_updated":"2018-05-18T01:10:09Z","snapshot_observed_at":"2026-07-06T06:39:50.447759Z","submitted_at":"2018-05-18T01:10:09Z","title":"Learning Permutations with Sinkhorn Policy Gradient","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.07010","snapshot_observed_at":"2026-08-08T19:03:05.394095Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.394095Z"},"links":{"cited_paper":"/paper/1805.07010","citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:102b981cfc048c1df7edc378bd17ca09d1ba47e340d4409de9c5bc7c254159a7","observation_id":"6fe79b74-02fa-480e-89a8-c4f60958210f","resolution":{"observed_at":"2026-08-08T19:03:05.394095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.357420Z","title":"Generalize a small pre-trained model to arbitrarily large tsp instances","venue":null,"work_id":"14833f1d-7eac-4474-a595-b59322c41265","year":2021},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.399133Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:52a65089d110a54d107135254c34032dd355f9c159cfc19bb1efd4916c4547d6","observation_id":"74691e8f-3ad9-44be-a04c-ad897a778d18","resolution":{"observed_at":"2026-08-08T19:03:06.361992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00016","last_updated":"2024-02-28T02:15:47Z","snapshot_observed_at":"2026-07-06T17:37:39.610989Z","submitted_at":"2024-02-28T02:15:47Z","title":"Deep Sensitivity Analysis for Objective-Oriented Combinatorial Optimization","version":1},"cited_work":{"arxiv_id":"2403.00016","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.00016","snapshot_observed_at":"2026-08-08T19:03:05.702657Z","title":"Deep Sensitivity Analysis for Objective-Oriented Combinatorial Optimization","venue":"cs.LG","work_id":"f3295dec-742f-4b96-960b-86997b5f25d4","year":2024},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.403352Z"},"links":{"cited_paper":"/paper/2403.00016","citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:6c5017bb1ec3e9a3879c38a8ffb5db7d6006124cdd920b81d8e293cc40687985","observation_id":"aa9ad8b4-5f2d-45dc-88e7-2bfdba7dc047","resolution":{"observed_at":"2026-08-08T19:03:05.709732Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.342138Z","title":"node2vec: Scalable feature learning for networks","venue":null,"work_id":"4fdab9cc-7ede-48a0-b7d5-ca08692f62fb","year":2016},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.407984Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:cfe446e9da91d344de6015e6a4589cc8be41e079a10ecf64d06ba7203513c779","observation_id":"bbf9f8ec-f50d-4c7f-94d2-e164ca2ec384","resolution":{"observed_at":"2026-08-08T19:03:06.346542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.327981Z","title":"Double q-learning","venue":null,"work_id":"3ce6398e-9271-4c65-aab9-23d7dc2a807e","year":2010},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.412203Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:eaa2d845c67dcee9493a62d4644c1e69996dbc4cf74c96289563287a7b1d361a","observation_id":"92a868bb-bc63-406c-80e1-5ec618317c80","resolution":{"observed_at":"2026-08-08T19:03:06.332009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.313410Z","title":"Efficient active search for combinatorial optimization problems","venue":null,"work_id":"eadc7680-35e2-4e91-ba1f-5bb31485e928","year":2021},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.417071Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:46f484ee28a2405125dada8a00536d608705cd9bf3c7c1f121d4849f1f4231b0","observation_id":"e64f3668-ab28-4724-a84d-f348a2ae5b93","resolution":{"observed_at":"2026-08-08T19:03:06.317716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.297446Z","title":"Convergence of stochastic iterative dynamic programming algorithms","venue":null,"work_id":"fe5d21d4-e0d4-409f-a524-6c8ff4b4614d","year":1993},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.422052Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:cbe4ef64b24c9ec9403b3dcf6845901b124c7908d56d9ce922350b5a1e64082a","observation_id":"40361bc2-72a8-449d-8805-1839b7c52e35","resolution":{"observed_at":"2026-08-08T19:03:06.302762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.280456Z","title":"Deep reinforcement learning approach to solve dynamic vehi- cle routing problem with stochastic customers","venue":null,"work_id":"b893144c-3108-4cc6-917a-cbe25171d8fb","year":2020},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.427074Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:fde486e56e8497d958fa327cc1183e6a9e63ea2609a721f4b8d27c1859f4a329","observation_id":"0a24db4d-80a0-4aab-965b-bac1f1209523","resolution":{"observed_at":"2026-08-08T19:03:06.285983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.263348Z","title":"Maximizing the spread of influence through a social network","venue":null,"work_id":"dd64c4d0-4b6a-4942-9461-52d148afe822","year":2003},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.432052Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:9baf1892a1eb35c21793ea7ea86dfddf5de9b36796ae5c158a047365400605d1","observation_id":"9a21f23e-ea64-4fd5-b9ad-2ed62956359d","resolution":{"observed_at":"2026-08-08T19:03:06.268148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.246499Z","title":"Learning combinatorial optimization algorithms over graphs","venue":null,"work_id":"1a44f9fa-33a6-47e4-a3bc-9f5bb9cd7980","year":2017},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.436959Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:633ab30abe29937304e00ea354fdfbfdf20b598860b907182c76fece1a5e0a74","observation_id":"2785ac3a-62da-4da8-b57b-e8fa6f42d1f1","resolution":{"observed_at":"2026-08-08T19:03:06.252054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.231064Z","title":"Semi-supervised classification with graph convolutional networks","venue":null,"work_id":"300b4211-41e1-46ae-a1b5-592d260936db","year":2016},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.441860Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:1afcf2545b8b239789e67bb25c50d4c60f4ec9882482ec501962d96aedcda22e","observation_id":"a2bb0535-2d7a-4016-9f72-c87ce1aecf1d","resolution":{"observed_at":"2026-08-08T19:03:06.235822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.214962Z","title":"Attention, learn to solve routing problems! In International Conference on Learning Representations, 2018","venue":null,"work_id":"cae13b91-06e5-47fc-a23b-a77f0fb68feb","year":2018},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.447001Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:77d1634dc1430b07f8725dde6c4a79b01d0a108b005d8f8118377d36ba9fbe07","observation_id":"1b5389a6-f425-482d-9f06-05742a76a4ca","resolution":{"observed_at":"2026-08-08T19:03:06.219988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.198505Z","title":"Hierarchical deep reinforcement learning: Integrating temporal abstraction and intrinsic motivation","venue":null,"work_id":"baa40b44-3b9f-4ee8-8291-76509efc777a","year":2016},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.451936Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:1e7ab5583c3c8b3b8b0f234de1f0ec2c237156530d7f96155b654d3d4c951655","observation_id":"4d7c55bb-7df6-4aab-82dc-e25f51a54107","resolution":{"observed_at":"2026-08-08T19:03:06.203778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.457088Z","title":"Pomo: Policy optimization with multiple optima for reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.457088Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:8960fd19c777c33fca3733f421a6bf020154a8094149602893f0bf378456f0c5","observation_id":"2cef4d40-8a12-49c3-9d15-bc00610ca9e1","resolution":{"observed_at":"2026-08-08T19:03:05.457088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.170863Z","title":"Mind dataset for diet planning and dietary healthcare with machine learning: dataset creation using combinatorial optimization and controllable generation with domain experts","venue":null,"work_id":"388c8262-c408-4968-8bf5-d1bbf1e7e004","year":2021},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.461851Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:f4d867c9d4a89ff1d934d754a09ee80e2982066c24ebaafbb06ec932bc9806a8","observation_id":"80205747-990b-40b6-84b7-8ba9815b5e4e","resolution":{"observed_at":"2026-08-08T19:03:06.176470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.466597Z","title":"Learning multi-level hierar- chies with hindsight","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.466597Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:29002d2e394bd865a3a7edc743d71a016b337e315c2929d5d8d7e6b71d0266c7","observation_id":"a2ac4060-43e0-48b6-8bd0-2fb646b53ad6","resolution":{"observed_at":"2026-08-08T19:03:05.466597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.144320Z","title":"Deeper Insights Into Graph Convolutional Networks for Semi-Supervised Learning","venue":null,"work_id":"5edc1b73-5b95-40ff-95f7-e3884e201671","year":2018},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.471258Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:a5a538de37934c453b7277f56d088077b42755528185eddbb665c379029cb1e0","observation_id":"eec2e7cf-b65b-412b-a3d1-67f2ee418624","resolution":{"observed_at":"2026-08-08T19:03:06.149253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.129849Z","title":"Deep-learning-based wireless resource allocation with application to vehicular networks","venue":null,"work_id":"a19910b7-6858-4847-bfd5-3a11dfe99c89","year":2019},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.475492Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:99a484baa4ccd2a43693ee78bf6b2a6e21b1e79041797270f0837c248fa539f4","observation_id":"53b0f20a-d133-472e-95af-d7c7763a832c","resolution":{"observed_at":"2026-08-08T19:03:06.134149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11829","last_updated":"2025-03-10T16:14:30Z","snapshot_observed_at":"2026-07-06T16:34:54.717394Z","submitted_at":"2023-10-18T09:31:21Z","title":"Graph Foundation Models: Concepts, Opportunities and Challenges","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11829","snapshot_observed_at":"2026-08-08T19:03:05.479770Z","title":"Towards graph foundation models: A survey and beyond","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.479770Z"},"links":{"cited_paper":"/paper/2310.11829","citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:b8e9294196eeddbb8ad379b0e109a5b11e96d2ce76d117ad12bd48bba2ae34d0","observation_id":"bb161e73-031d-4ca3-97ce-e66c00828c30","resolution":{"observed_at":"2026-08-08T19:03:05.479770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.115723Z","title":"A learning-based iterative method for solving vehicle routing problems","venue":null,"work_id":"c09a7ce5-4993-4c3d-8b2c-85849f8e3f98","year":2019},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.484808Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:f1a3fb9762d4789efbee90cad64e2a4e664a4513941a787e8b50b304b3f00fe1","observation_id":"30db095e-8246-41c7-bd14-7d30d5f6072c","resolution":{"observed_at":"2026-08-08T19:03:06.119961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.101518Z","title":"Reinforcement learning for combinatorial optimization: A survey","venue":null,"work_id":"cd7b0e00-183c-451f-bfa9-748bb4e7d6e9","year":2021},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.488997Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:9388baf2666cc7dde0a595a14842f02d91431565750f9be4d09470ccabed7a27","observation_id":"9a4472fc-995c-4090-96df-e06f811c33ba","resolution":{"observed_at":"2026-08-08T19:03:06.105831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-08T19:03:05.494362Z","title":"Playing atari with deep reinforcement learning","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.494362Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:85c676248e486574f55d2153fe1d2d53c8bf54a1744d516a9beb00c552ee0447","observation_id":"967d589c-0932-4ad7-811d-7b08b4d7210d","resolution":{"observed_at":"2026-08-08T19:03:05.494362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.499797Z","title":"Human-level control through deep reinforcement learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.499797Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:690ebf29e9ef472bbadd55c00401b148836d7ffb8cfe3e263c48ab3e51a71999","observation_id":"207edfba-cd35-45a7-9863-a94c18bb49a8","resolution":{"observed_at":"2026-08-08T19:03:05.499797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.076264Z","title":"Data-efficient hierarchical reinforcement learning","venue":null,"work_id":"76ecec98-9c9a-427e-8877-86564c9af4ae","year":2018},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.504359Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:0a957f54447316424ec07536df7977f11c2825c7be54ebf0ded2ee06e3924fdd","observation_id":"cf0b18ab-bd0d-429a-9660-4e91e7b6b0d7","resolution":{"observed_at":"2026-08-08T19:03:06.081050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.060143Z","title":"Reinforcement learning for solving the vehicle routing problem","venue":null,"work_id":"33c4cb39-9ca8-4eb8-9c8f-d889610347fa","year":2018},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.509865Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:78f61710ecb2f4478eab5741a68cdc4fb2cfa2020ff99c463fc3e6a66f59351d","observation_id":"2ff9a79b-80bf-4460-8447-9033028d33bb","resolution":{"observed_at":"2026-08-08T19:03:06.065490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.043861Z","title":"Solo: search online, learn offline for combinatorial optimization problems","venue":null,"work_id":"ab9d140a-fa94-4a31-901c-c4f195454f44","year":2021},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.514510Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:d4e29e345b59b9b32895c91ee9f278f5a6500b66c053e8689d5734c0e9ac4194","observation_id":"246a2440-7e7b-43bc-af6b-ae762afb04a0","resolution":{"observed_at":"2026-08-08T19:03:06.048989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.028072Z","title":"Active screening for recurrent diseases: A reinforcement learning approach","venue":null,"work_id":"8b0ffca6-4a3a-462f-ba45-869dec3d95ec","year":2021},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.526265Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:70eb045bf680127d499e68f2a9823e2537fa207def35e2ad9786b24cd98a1002","observation_id":"83b47402-5b46-4d48-ad9d-f6127206dc96","resolution":{"observed_at":"2026-08-08T19:03:06.033330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:06.012695Z","title":"Adaptive influence maximization with myopic feedback.Advances in Neural Information Processing Systems, 32, 2019","venue":null,"work_id":"31e322c9-bfd3-4eff-bc8c-0ce16d403173","year":2019},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.531358Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:b16a48f3232b6f8a5acbf9196d90f809a62507fd5f35ab7c071956e13d9ed479","observation_id":"8b6c6c81-7f71-49d5-af77-7c80f94e8b0f","resolution":{"observed_at":"2026-08-08T19:03:06.017390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.997593Z","title":"Deepwalk: Online learning of social repre- sentations","venue":null,"work_id":"fdde3aaf-246d-4e8a-a13d-1a4205dd3545","year":2014},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.536450Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:7ca81c43eaf5578ff5349411d3b300892d6f988124652ae5e956ad06e3399695","observation_id":"828aafdf-ef8f-4fef-89bf-07e24994a913","resolution":{"observed_at":"2026-08-08T19:03:06.002672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.981749Z","title":"Scarselli, M","venue":null,"work_id":"b3281f22-89a2-4bc1-8cd8-4f2cf03a5f1f","year":2009},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.542776Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:a5481fafff51ec47344dd01d8e01ffcb7fd23a92a590ddfe7c2e139e5d98631b","observation_id":"9a8c371d-4573-41fe-abc6-965b6d67feb0","resolution":{"observed_at":"2026-08-08T19:03:05.986934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.548651Z","title":"Combinatorial optimization with physics-inspired graph neural networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.548651Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:3312877800c8c21e3f523b9286866c1b5e7aa3f3de01d8c5ae7b24ddf0b2def4","observation_id":"3b84c475-f100-4b82-aca3-724f22386111","resolution":{"observed_at":"2026-08-08T19:03:05.548651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.954325Z","title":"Learning to predict by the methods of temporal differences","venue":null,"work_id":"e2f65601-9e7b-45b1-905d-1acc440e6c63","year":1988},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.553555Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:3070a8477ad747ec21f099324cd7e6aacc12dc7341a2dbc2afd3459d29d8960e","observation_id":"d58d75d6-008c-4983-9f35-cf0c142f8d09","resolution":{"observed_at":"2026-08-08T19:03:05.958959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.938419Z","title":"Between mdps and semi-mdps: A framework for temporal abstraction in reinforcement learning","venue":null,"work_id":"61927259-7112-4d2d-9aea-429acc58ac3c","year":1999},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.558800Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:7691c89edae8a6912803fb38d77f8b0a87f9866cf641d32aefd139ab3ca6fcf5","observation_id":"87d164f2-5c43-4c6c-854f-37a091e712aa","resolution":{"observed_at":"2026-08-08T19:03:05.943619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.921407Z","title":"Time-constrained adaptive influence maximization","venue":null,"work_id":"7047245e-a1c0-4fc6-99ad-48dd346bfcd9","year":2020},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.562939Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:a76aa5f9bd1d5161946ee7e419ba57c14653c33423aef9f5e32ef6691ea318d1","observation_id":"f83cec7f-51d8-46ce-bb53-7d15a57cd815","resolution":{"observed_at":"2026-08-08T19:03:05.926788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.903496Z","title":"Graph attention networks","venue":null,"work_id":"fa4753f5-7f36-4e97-9c21-f5a67efae3d4","year":2018},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.567015Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:1b6148167c6453e38178122b4241cca51702d74e59e35f7db922e73171a39b2f","observation_id":"279574b4-c7a4-4f92-85b6-13b4b0a75da0","resolution":{"observed_at":"2026-08-08T19:03:05.908402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.884726Z","title":"Feudal networks for hierarchical reinforcement learning","venue":null,"work_id":"6490a1aa-db20-49fc-b6b9-5e70cfa1c82e","year":2017},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.571246Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:de39b33fb9f4206cd36f812922e8a2de9be58d7c2407141648380c0711d48f18","observation_id":"d64edccd-f62f-4dcc-be02-b3ef8e8cd0e6","resolution":{"observed_at":"2026-08-08T19:03:05.890658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.868690Z","title":"Q-learning","venue":null,"work_id":"48138f66-a506-4a7e-b71b-31a0d5ca26d1","year":1992},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.576211Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:bce8768bdf3c10e693187d4e423d79e5c5a1da051008b8fa28ac430ff720e804","observation_id":"761b4a4b-41cc-4472-836b-2eae7c724760","resolution":{"observed_at":"2026-08-08T19:03:05.873513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.851190Z","title":"On efficiency in hierarchical reinforcement learning","venue":null,"work_id":"e2c13e3c-9d05-4706-baa7-2e19854d6c8f","year":2020},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.581755Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:bfde5aa5b7c6bb08f6e920e2b197255728ebc8f15f0e0475d2327121335b6dff","observation_id":"94f9e66f-b35b-41b9-8587-bfd7d718a5b7","resolution":{"observed_at":"2026-08-08T19:03:05.857250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.833274Z","title":null,"venue":null,"work_id":"817a3113-8293-4de5-8437-77756c445be1","year":2021},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.587774Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:d10a49334866f66c76aed5f583ff0fa1fde694c9f892721688367d59009368e2","observation_id":"dcb0eca0-bb02-48f1-8da4-797527bdb221","resolution":{"observed_at":"2026-08-08T19:03:05.838649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.00826","last_updated":"2019-02-22T19:15:54Z","snapshot_observed_at":"2026-07-06T07:05:24.565760Z","submitted_at":"2018-10-01T17:11:31Z","title":"How Powerful are Graph Neural Networks?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.00826","snapshot_observed_at":"2026-08-08T19:03:05.592590Z","title":"How powerful are graph neural networks? arXiv preprint arXiv:1810.00826, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.592590Z"},"links":{"cited_paper":"/paper/1810.00826","citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:67a89e86378b0641d6f61be9503e058db276be03bcce306ddbf365532ae7f326","observation_id":"49ba5402-4cf3-4dd3-8839-9d705c867b04","resolution":{"observed_at":"2026-08-08T19:03:05.592590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.816271Z","title":"Accelerating Exact Combinatorial Optimization via RL-based Ini- tialization - A Case Study in Scheduling","venue":null,"work_id":"f3ed94a3-d5a3-4504-a0f6-1c540ba8fa11","year":2023},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.597802Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:6e863dbdd9d1970464f94228e01c5b697fcc3dbb9eff251b796aa63c3f7f9863","observation_id":"23ad6750-cbdc-4758-b9ac-cac85fe42033","resolution":{"observed_at":"2026-08-08T19:03:05.821556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.799742Z","title":"Gnnexplainer: Generating explanations for graph neural networks","venue":null,"work_id":"92423284-c3fb-41c8-a054-e871a40879aa","year":2019},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.602875Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:d1d56c2c37873b18831ddb237aaeed98b8e4335e20a6fbfa8de3adc4e7e3057a","observation_id":"e364317d-dd16-435b-b6a0-fb87109b78ec","resolution":{"observed_at":"2026-08-08T19:03:05.805142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.784173Z","title":"Graph transformer networks","venue":null,"work_id":"9f9c04f9-1690-495c-a21b-0d43956404a1","year":2019},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.607378Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:200ba458cf4678a7ba7d1d5539c23bb528e0e9772a4fa9cfd71653bc20be3a03","observation_id":"d38485cb-03f0-466e-b2e2-d4abaa383722","resolution":{"observed_at":"2026-08-08T19:03:05.788657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T19:03:05.769419Z","title":"Graph neural networks: A review of methods and applications","venue":null,"work_id":"65ff13cd-4f66-4455-aa69-c539ef883034","year":2020},"citing_paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T19:03:05.612017Z"},"links":{"citing_paper":"/paper/2502.05537"},"observation_digest":"sha256:912ded29835b15d7ccc07dd472ae40c940ec43588431f6ad55f9941a0b269c44","observation_id":"b8b130ab-4d76-4cf8-bdee-1637f0c75ed7","resolution":{"observed_at":"2026-08-08T19:03:05.773978Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.05537","last_updated":"2025-02-08T12:00:30Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T13:04:16.332693Z","submitted_at":"2025-02-08T12:00:30Z","title":"Sequential Stochastic Combinatorial Optimization Using Hierarchal Reinforcement Learning"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":44},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 1 inbound Pith citation observation for arXiv:2502.05537."}