{"as_of":"2026-08-22T04:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1f950f5c9243cb86abc94ae86dffbc7674340749925bdb7f15fe667794785d89","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T00:28:28.594848Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.00750/citation-record","integrity":"/paper/2608.00750/integrity","json":"/paper/2608.00750/citation-record.json","paper":"/paper/2608.00750"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:19.052561Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:19.052561Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:d059164f186057b91e6161cef26449738ecdecffcefb2ed7bbd38056202e900d","observation_id":"f6b3d903-e83e-4a0f-9cdf-e3e1f4a56e3d","resolution":{"observed_at":"2026-08-05T00:28:19.052561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.07086","last_updated":"2017-03-03T15:43:52Z","snapshot_observed_at":"2026-08-14T21:47:03.259242Z","submitted_at":"2016-07-24T20:05:07Z","title":"An Actor-Critic Algorithm for Sequence Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.07086","snapshot_observed_at":"2026-08-05T00:28:19.184842Z","title":"Courville, and Yoshua Bengio","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:19.184842Z"},"links":{"cited_paper":"/paper/1607.07086","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:8090ecf5db1c3db4ac389992608b2770eb4b5b3ccc0be39fbf5f126f72fde533","observation_id":"3c69e743-2561-430a-aab8-f1f23f3c19fb","resolution":{"observed_at":"2026-08-05T00:28:19.184842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:48.498716Z","title":"Charles, D","venue":null,"work_id":"62e2aa93-e77f-4582-98bd-98bdeb6b686b","year":2013},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:19.318532Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:6d689aadb7afd1e015225d2aadcd7a3a8e9e433ab04bfcf34c72a18fa0205024","observation_id":"6b7cbcb2-1eda-4b74-ab5e-99a41c83a0fb","resolution":{"observed_at":"2026-08-05T00:28:48.814768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01345","last_updated":"2021-06-24T17:09:59Z","snapshot_observed_at":"2026-08-19T12:22:46.459617Z","submitted_at":"2021-06-02T17:53:39Z","title":"Decision Transformer: Reinforcement Learning via Sequence Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.01345","snapshot_observed_at":"2026-08-05T00:28:19.394252Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:19.394252Z"},"links":{"cited_paper":"/paper/2106.01345","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:e24991b332b7330d5f95773882bdcd5bf8f9e6af914d12cd49a7a0acaab49ed0","observation_id":"49a4c10f-2a3a-43a6-a859-be44c2e9abd6","resolution":{"observed_at":"2026-08-05T00:28:19.394252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09215","last_updated":"2024-11-07T18:30:53Z","snapshot_observed_at":"2026-08-21T13:52:29.238316Z","submitted_at":"2024-06-13T15:16:11Z","title":"On Softmax Direct Preference Optimization for Recommendation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09215","snapshot_observed_at":"2026-08-05T00:28:19.449017Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:19.449017Z"},"links":{"cited_paper":"/paper/2406.09215","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:16d5043c040637572d6282cd713bcc2a9f48fd26475beb1787231cd515b1510e","observation_id":"a11a2abc-46f6-4e0e-93aa-17f9b87f18dc","resolution":{"observed_at":"2026-08-05T00:28:19.449017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03741","last_updated":"2023-02-17T17:00:34Z","snapshot_observed_at":"2026-08-12T12:29:44.507445Z","submitted_at":"2017-06-12T17:23:59Z","title":"Deep reinforcement learning from human preferences","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03741","snapshot_observed_at":"2026-08-05T00:28:19.534747Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:19.534747Z"},"links":{"cited_paper":"/paper/1706.03741","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:4c28d2164b049ae53331468166a6c6bb45c5001807491dbd3989e3195441744e","observation_id":"0d305c4d-5e60-4a38-a570-2d9d37e98ac1","resolution":{"observed_at":"2026-08-05T00:28:19.534747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:19.631829Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:19.631829Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:6365413ef91f7314454a35da796f9eb40034181b19e390753056f35bd6db361c","observation_id":"068d50b9-6fb4-490e-8b87-0789504290aa","resolution":{"observed_at":"2026-08-05T00:28:19.631829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18965","last_updated":"2025-02-26T09:25:10Z","snapshot_observed_at":"2026-08-11T02:18:35.186995Z","submitted_at":"2025-02-26T09:25:10Z","title":"OneRec: Unifying Retrieve and Rank with Generative Recommender and Iterative Preference Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18965","snapshot_observed_at":"2026-08-05T00:28:19.720042Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:19.720042Z"},"links":{"cited_paper":"/paper/2502.18965","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:813c590ab5dc184ce6525a860d34c621b58f736ccacefb123f75f35911edd0e1","observation_id":"82066883-ec5c-4a99-9233-c5563323bf2b","resolution":{"observed_at":"2026-08-05T00:28:19.720042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:48.155454Z","title":null,"venue":null,"work_id":"09215097-81f2-41c8-8bd2-fd361efd60e2","year":2011},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:19.815816Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:7a44b46048cfa23f0ccdfd4fd270cd15f4eb9f8bd5af70ee41d99739869a0ba0","observation_id":"743993e2-f8ae-4fa1-8e5a-4bf5d36b7eac","resolution":{"observed_at":"2026-08-05T00:28:48.274001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:19.914046Z","title":null,"venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:19.914046Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:6d07ea09a34275cce40f104ce84e7a42927b7ffd8e20cf5dea0756e001a33974","observation_id":"d133d8b5-7bf2-4e08-ba8c-8a330790c840","resolution":{"observed_at":"2026-08-05T00:28:19.914046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.09477","last_updated":"2018-10-22T17:37:07Z","snapshot_observed_at":"2026-08-21T04:50:31.604571Z","submitted_at":"2018-02-26T17:54:49Z","title":"Addressing Function Approximation Error in Actor-Critic Methods","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.09477","snapshot_observed_at":"2026-08-05T00:28:19.975280Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:19.975280Z"},"links":{"cited_paper":"/paper/1802.09477","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:67f8d4731b19e2460f475e8391dbc068d922241deed93431f5dc465618304493","observation_id":"598db00d-e391-4354-975d-4a069ccfaf8a","resolution":{"observed_at":"2026-08-05T00:28:19.975280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6410.37145","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:44.584833Z","title":null,"venue":null,"work_id":"ec8f4c1d-6adc-4713-b3d8-8bda53edcf76","year":2025},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:20.063957Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:27b4635e58e75af95e42470f24ea91cf5ee2000609deaaa05f919ef4f7c922ff","observation_id":"53d9743a-24f5-43d3-b1fd-a02871378338","resolution":{"observed_at":"2026-08-05T00:28:44.744998Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:20.134128Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:20.134128Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:67084f244d7b283129652a5ea78b0257e96d6a2ee497aa94700a04221900a682","observation_id":"2647b977-c7d8-4eeb-911c-f409f49f85bb","resolution":{"observed_at":"2026-08-05T00:28:20.134128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2504.14587","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"ArXiv.org","work_id":"a73b933e-1e0f-4689-b0c0-b019147af658","year":2025},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:20.244756Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:c693c6d78805a68e26437ad3d4ad13286beb756b8760621c80ba6a6d9b5c000d","observation_id":"1cdaa22a-6501-4a72-a2f2-ebc018be19b6","resolution":{"observed_at":"2026-08-05T00:28:34.895078Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-07T21:08:25.83684+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T21:08:25.83684+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3227.35467","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:43.968691Z","title":null,"venue":null,"work_id":"cb8e0c7a-156d-4897-bec8-4e536050c98d","year":2022},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:20.289983Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:dca2d850399c90ac1d607af7e290ebe76048008484c5a2437ac1ac2cbbdedd03","observation_id":"ca8f2e29-f19b-4023-b53c-4d658d7ec93a","resolution":{"observed_at":"2026-08-05T00:28:44.104897Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:20.402766Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:20.402766Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:3498ddae9d632e142ec95e412988454e3a8ca7e314872c7bf829a9605fc92915","observation_id":"8ed65f10-0cf5-475d-a56d-3a9508d14814","resolution":{"observed_at":"2026-08-05T00:28:20.402766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13581","last_updated":"2025-08-15T23:44:20Z","snapshot_observed_at":"2026-08-19T16:37:42.784353Z","submitted_at":"2025-02-19T09:45:29Z","title":"ActionPiece: Contextually Tokenizing Action Sequences for Generative Recommendation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13581","snapshot_observed_at":"2026-08-05T00:28:20.634756Z","title":"Chi, Julian McAuley, and Derek Zhiyuan Cheng","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:20.634756Z"},"links":{"cited_paper":"/paper/2502.13581","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:cc43a0889cc26548d82dadcaf6e473f1c063ab9168252fab33e75a552a5bed97","observation_id":"90fecece-1fc1-4895-9fda-4d74f8cb0803","resolution":{"observed_at":"2026-08-05T00:28:20.634756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.04847","last_updated":"2019-09-26T13:30:53Z","snapshot_observed_at":"2026-08-13T18:02:03.194823Z","submitted_at":"2019-09-11T04:43:45Z","title":"RecSim: A Configurable Simulation Platform for Recommender Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.04847","snapshot_observed_at":"2026-08-05T00:28:20.798569Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:20.798569Z"},"links":{"cited_paper":"/paper/1909.04847","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:da625c73a8119f43e4bf335807697cacccd1175437c7f777384947ca39fa5008","observation_id":"cd03a16b-dbe5-4d8f-afce-df65e233c3b5","resolution":{"observed_at":"2026-08-05T00:28:20.798569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:20.857847Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:20.857847Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:b28cb42c8a2a7fa7f559d1c5016e8f277c2ff3f6296342c8f7470127107b3593","observation_id":"43bc848a-6a46-48d0-ade3-5721af5c31e3","resolution":{"observed_at":"2026-08-05T00:28:20.857847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.11578","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:41.916611Z","title":null,"venue":null,"work_id":"5447bf3b-c1a9-4005-aad5-156ef96b57c1","year":2023},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:20.975364Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:252a23de2f64786959532202923d28acd425acdcb4b1c798fbeb723cc45105d4","observation_id":"90c20684-407b-47e0-b5a9-3ea36e469ac3","resolution":{"observed_at":"2026-08-05T00:28:42.907035Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:21.011004Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:21.011004Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:6d78157e9902bbf0627db4fe03e11ebafd5f2776000fc189539e89358296a839","observation_id":"998ef819-b099-40fd-96f3-990f9f217f9b","resolution":{"observed_at":"2026-08-05T00:28:21.011004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:21.210431Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:21.210431Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:9585330cd778a9392e15766a63291080fd4132e44f73e1effb24885324cfa15d","observation_id":"a1da817b-8173-4169-83de-c5f8bc91e19b","resolution":{"observed_at":"2026-08-05T00:28:21.210431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9530.23396","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:41.021265Z","title":null,"venue":null,"work_id":"fb6ecf28-b2d1-46b0-98f1-ce61c2659836","year":2012},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:21.280404Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:0fcceca9c8084925deedec49f197491ba3cd2f2d0911d4c4719901039df26998","observation_id":"33218b36-3103-4d22-a328-5c1f57c4cf5e","resolution":{"observed_at":"2026-08-05T00:28:41.165374Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:21.404747Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:21.404747Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:856768611f5a3d9be2c9cf67fbee67d94b2c72d40d6f87cc5fb97f3994853279","observation_id":"4549bf14-6f92-463d-a05e-504615575201","resolution":{"observed_at":"2026-08-05T00:28:21.404747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-08-17T01:47:25.235810Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-08-05T00:28:21.497424Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:21.497424Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:2538c8e266d7623f70acde84ef325598c40509e5bccf9c3a045812097e26b09c","observation_id":"460194cc-9184-4098-9d02-d495822f57c1","resolution":{"observed_at":"2026-08-05T00:28:21.497424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:21.566779Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:21.566779Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:5b9cf53801726de3988f672f29382bf702d74657f75b72e23047743f8bde4cb8","observation_id":"59c01b23-d891-4a6b-b763-f3bde21e3146","resolution":{"observed_at":"2026-08-05T00:28:21.566779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5826.19358","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:39.954759Z","title":null,"venue":null,"work_id":"42837a59-8cd3-4467-99ab-e0a162d22561","year":2011},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:21.639499Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:a034f0f437b11ec932eb1621bfed2aff369cf1c1070c24882418e0219b610a4c","observation_id":"f5a62ca2-d253-4aaa-96b7-64bd5f2968de","resolution":{"observed_at":"2026-08-05T00:28:40.267957Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-16T22:06:26.835611Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-05T00:28:21.757339Z","title":"Lillicrap, Jonathan J","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:21.757339Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:60bc4919e8ec0948df72744b59bbbcd94a89a3ec42eff6eeed57f763ee4b9f26","observation_id":"14d32725-3f45-4505-bd19-941e802830b7","resolution":{"observed_at":"2026-08-05T00:28:21.757339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:39.344771Z","title":null,"venue":null,"work_id":"53237eed-76d8-433b-9ea2-f67c88c4de1f","year":2023},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:21.828875Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:ad396004c61071d511a13bff832c3ed52a3995950614d55c490a39139dfc001f","observation_id":"b6cc294a-3f72-4a1f-8f4b-3d6d6ce5775c","resolution":{"observed_at":"2026-08-05T00:28:39.434756Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:47.591647Z","title":null,"venue":null,"work_id":"37675acc-2882-4fa1-a08b-fe7532c867ab","year":2013},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:21.903373Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:005fafa7c9e5ad63f9bfaffcf6f0d7069528655541f58c07b684aa3b57995a20","observation_id":"f94485d9-3769-4efd-a171-24f211a4cecd","resolution":{"observed_at":"2026-08-05T00:28:47.864764Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.01783","last_updated":"2016-06-16T16:38:45Z","snapshot_observed_at":"2026-08-17T11:02:06.117758Z","submitted_at":"2016-02-04T18:38:41Z","title":"Asynchronous Methods for Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.01783","snapshot_observed_at":"2026-08-05T00:28:22.105962Z","title":"Lillicrap, Tim Harley, David Silver, and Koray Kavukcuoglu","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:22.105962Z"},"links":{"cited_paper":"/paper/1602.01783","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:303c3273dc7d4da042a4c310badd3eea5914a48a85e6867023dc40e4a1a807f5","observation_id":"1b3c4aae-a291-4a4e-9c34-4ab197910224","resolution":{"observed_at":"2026-08-05T00:28:22.105962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:22.188539Z","title":"Ng, Daishi Harada, and Stuart Russell","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:22.188539Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:b68728a5a0293324419feb04b66033235f7dde08678f31b133de8f628cd89445","observation_id":"bcf770e6-3096-4d4f-a6b9-5b09c93cb777","resolution":{"observed_at":"2026-08-05T00:28:22.188539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-05T00:28:22.275051Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:22.275051Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:f817dc1af7016c0ccaad5b46b5876a9eecf823f8e607f5986e80178781edc09e","observation_id":"d7bc9ca1-0dcf-4398-8908-2686bc05f171","resolution":{"observed_at":"2026-08-05T00:28:22.275051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:47.284852Z","title":null,"venue":null,"work_id":"b7f20d85-580c-4b13-8c13-42b442b77337","year":1975},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:22.391983Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:b089c19404a092677a07c07280e2a82045747ce252fb80f24c9638064c80d262","observation_id":"2b002aa4-1e1c-4cf8-a2a7-e9af9c5caad0","resolution":{"observed_at":"2026-08-05T00:28:47.394859Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-05T00:28:22.469500Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:22.469500Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:4dd75f1bde1bb6962b7a8c82941dc9021b0d20b470c66d1f73545decda97bf1c","observation_id":"68e83215-d09a-46f8-b177-3f2c5e04ad44","resolution":{"observed_at":"2026-08-05T00:28:22.469500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05065","last_updated":"2023-11-03T18:02:56Z","snapshot_observed_at":"2026-08-20T05:54:51.765124Z","submitted_at":"2023-05-08T21:48:17Z","title":"Recommender Systems with Generative Retrieval","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05065","snapshot_observed_at":"2026-08-05T00:28:22.604793Z","title":"Tran, Jonah Samost, Maciej Kula, Ed H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:22.604793Z"},"links":{"cited_paper":"/paper/2305.05065","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:02f0f0908be9dd0c307861a33ba2b3b2235c1d9a155eb282d6589841ecc4336c","observation_id":"a1e39e40-449c-4cc3-8937-6319bb528cfd","resolution":{"observed_at":"2026-08-05T00:28:22.604793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06732","last_updated":"2016-05-06T21:18:46Z","snapshot_observed_at":"2026-08-14T22:21:58.983002Z","submitted_at":"2015-11-20T19:25:54Z","title":"Sequence Level Training with Recurrent Neural Networks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06732","snapshot_observed_at":"2026-08-05T00:28:22.654870Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:22.654870Z"},"links":{"cited_paper":"/paper/1511.06732","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:a0d45c9eeba91d136f504217c5003e7ceb79df1d0b2d59c4e875baf156ae5b00","observation_id":"85da4500-93bf-4bf3-b93f-997bd6966f1f","resolution":{"observed_at":"2026-08-05T00:28:22.654870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:22.723679Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:22.723679Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:083242b9f2821a401560e8f26c78166f5a246eec74ae9f4cf27a304112e90383","observation_id":"94b1613b-fb49-48a7-9ba1-ddd815cebabb","resolution":{"observed_at":"2026-08-05T00:28:22.723679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:22.915001Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:22.915001Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:a4161cf00ae6d97a44bfc40a7daf78d83004cfb71360b4b8ae7f9940d6145c83","observation_id":"4433ad17-b629-4994-a868-64b06f55ddbb","resolution":{"observed_at":"2026-08-05T00:28:22.915001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:23.117426Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:23.117426Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:8cd0f917f3d12f3982ab7ead37e7dd1c6ec02964762454df8fb490c7797c399d","observation_id":"f49e6042-6501-4ae3-8b44-e72180f2c561","resolution":{"observed_at":"2026-08-05T00:28:23.117426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T00:28:23.847914Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:23.847914Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:7fc31b2f58e70c749cfb99d144c0532a61390221d578827c3a3a62961fa7f496","observation_id":"462b93c7-20c1-4145-ab9e-693b19c9ba05","resolution":{"observed_at":"2026-08-05T00:28:23.847914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:25.069452Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:25.069452Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:e18d8179f41264499222fc2995d51241692eac8241685ce3ef6db5361d623470","observation_id":"378e2ecd-b4ec-4f9f-86e2-27eed698dc49","resolution":{"observed_at":"2026-08-05T00:28:25.069452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:25.755221Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:25.755221Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:c88ab9043515cd9dd3c71645512548d72b268ea85a6c2b4e22b5c7ce489e4be0","observation_id":"9efcc24e-53c6-4771-9480-ae39402eb425","resolution":{"observed_at":"2026-08-05T00:28:25.755221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-15T05:06:05.489107Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-05T00:28:23.002111Z","title":"arXiv:1506.02438 Hierarchical Residual Policy Optimization for Generative Recommendations KDD ’26, August 09–13, 2026, Jeju Island, Republic of Korea","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:23.002111Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:c9efd1cbbfa9067f13c299471dbd392f51a1a2947bc789a885b852f319d2c734","observation_id":"a20f4299-2f59-4130-b079-c38fcb4226f2","resolution":{"observed_at":"2026-08-05T00:28:23.002111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1502.02362","last_updated":"2015-05-20T23:29:49Z","snapshot_observed_at":"2026-08-20T04:14:59.355261Z","submitted_at":"2015-02-09T05:09:25Z","title":"Counterfactual Risk Minimization: Learning from Logged Bandit Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.02362","snapshot_observed_at":"2026-08-05T00:28:25.991755Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:25.991755Z"},"links":{"cited_paper":"/paper/1502.02362","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:f2797a1ab3c64c563859acb3ce69b503501489ca9697d797b196deb75cdabc6c","observation_id":"64229d29-411d-45c4-beff-db359364cd2d","resolution":{"observed_at":"2026-08-05T00:28:25.991755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2510.12211","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"arXiv (Cornell University)","work_id":"6450a9f6-baca-4575-b14c-bcda1048c23c","year":2025},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:26.045125Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:1fae556587b52ea3d0a54b3275aeb886f4e0e1968106917862da85eba79ead09","observation_id":"9745843c-56f4-4847-8c61-3001cf869558","resolution":{"observed_at":"2026-08-05T00:28:32.001329Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-07T21:08:26.776779+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T21:08:26.776779+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0270.36018","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:36.764761Z","title":"Tran, Mostafa Dehghani, Jianmo Ni, Dara Bahri, Harsh Mehta, Zhen Qin, Kai Hui, Zhe Zhao, Jai Gupta, Tal Schuster, William W","venue":null,"work_id":"56c4b9c3-08c4-48ba-ada6-26880103926c","year":2022},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:26.147910Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:12b36366f0943897684de71c0f46e02895d836de3bbcefebbf7ddc8761a3f30f","observation_id":"5834341c-e4ff-42f9-b907-75214a7927ca","resolution":{"observed_at":"2026-08-05T00:28:37.092313Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.ijcnlp-long.180","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"cf0c7bda-c3fc-4005-9046-2c312a1842e4","year":2025},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:26.267865Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:3ac23b513797ebf1229893e14b424c890604316344aa2b3c255d7272afff6fcb","observation_id":"9d91c1ac-4ad1-4680-bd19-d49cc9063474","resolution":{"observed_at":"2026-08-05T00:28:31.454859Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-07T21:08:27.057692+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T21:08:27.057692+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3812652","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"ACM Transactions on Information Systems","work_id":"ad0ec984-d72b-486e-92bd-724d7c728ba5","year":2026},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:26.338955Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:94b1680dc0007aa1c895a1b7e1155cacc4f3059c07ce658432e7c259958c0f9a","observation_id":"2893966d-ffca-495b-8b00-2915b2c37ac4","resolution":{"observed_at":"2026-08-05T00:28:30.976295Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-07T21:08:27.519882+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T21:08:27.519882+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5555/3312046","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:32.202918Z","title":"Sutton and Andrew G","venue":null,"work_id":"62cf744f-3767-463b-88d0-57613ba3e2b7","year":2018},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:25.886494Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:25c841fd982277debc573ec8efb0494c06b460c233048faec120c50c183ce747","observation_id":"6d26ba5b-4c87-451c-8bfb-2a787c6cb060","resolution":{"observed_at":"2026-08-05T00:28:32.345034Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-07T21:08:27.67432+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T21:08:27.67432+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.16114","last_updated":"2026-06-01T12:57:38Z","snapshot_observed_at":"2026-08-14T21:58:21.135858Z","submitted_at":"2025-06-19T08:04:31Z","title":"GFlowGR: Fine-tuning Generative Recommendation Frameworks with Generative Flow Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.16114","snapshot_observed_at":"2026-08-05T00:28:26.640363Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:26.640363Z"},"links":{"cited_paper":"/paper/2506.16114","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:7a65b9586d2ca6c3c3d78d4920c6cffccdc2495de044d3919cc8ec6480759a07","observation_id":"3863b1da-6aeb-4d5b-9a64-5e174f9a972c","resolution":{"observed_at":"2026-08-05T00:28:26.640363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:46.722423Z","title":null,"venue":null,"work_id":"dd667512-ca7b-4156-b70f-0a3a38563f84","year":null},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:26.776581Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:a74aa7bb6d2e726cb4392dc0c8958af47006aff8cdc8b102eb5c8e9a5c992ec8","observation_id":"381df897-f5a9-4228-a0f8-02621a47b725","resolution":{"observed_at":"2026-08-05T00:28:46.804765Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:27.014976Z","title":"Williams","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:27.014976Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:3344696ace18879f076b1623efaeb79ea7848b9125023ad24b6f8d795fcb7068","observation_id":"cdcd148b-fe2b-4fab-a84b-daf58e7949e1","resolution":{"observed_at":"2026-08-05T00:28:27.014976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:27.166451Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:27.166451Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:262836cccd4c2d45e2410f64ca4549dfd652890b9f61538803e49d8289d32d5d","observation_id":"65383475-c49b-44b8-b2f2-80f4038dd302","resolution":{"observed_at":"2026-08-05T00:28:27.166451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12645","last_updated":"2023-10-19T07:36:03Z","snapshot_observed_at":"2026-08-16T14:58:32.924800Z","submitted_at":"2023-09-22T06:29:29Z","title":"KuaiSim: A Comprehensive Simulator for Recommender Systems","version":2},"cited_work":{"arxiv_id":"2309.12645","doi":"10.48550/arxiv.2309.12645","metadata_source":"pith","pith_arxiv_id":"2309.12645","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"KuaiSim: A Comprehensive Simulator for Recommender Systems","venue":"cs.IR","work_id":"0a9d0ea7-83fb-416c-8bcd-2ace81c53b1c","year":2023},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:27.290669Z"},"links":{"cited_paper":"/paper/2309.12645","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:85db5639d0ce0ce29830afaa6aed91cbbcbf04218a0f52bc84eebcf1d526bc01","observation_id":"e67a26db-dec7-4545-a632-5caf994f4bca","resolution":{"observed_at":"2026-08-05T00:28:29.825114Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-07T21:08:28.097087+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T21:08:28.097087+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:26.494756Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:26.494756Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:f1f3702e7b65a4b92c0fa00dd20ba941853c349b0e6cd438e0dbee3771e2a07c","observation_id":"8e531ac3-1a8e-4e23-ba27-1b7e454083a9","resolution":{"observed_at":"2026-08-05T00:28:26.494756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:27.542656Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:27.542656Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:fef713b18324484ebf6872cd00283b2d51e1254dd8b27c414e6f21631408af47","observation_id":"e6ef8dea-622e-483b-a04e-028c30172fd1","resolution":{"observed_at":"2026-08-05T00:28:27.542656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04400","last_updated":"2025-05-25T06:28:48Z","snapshot_observed_at":"2026-08-20T08:51:31.353246Z","submitted_at":"2025-04-06T08:03:03Z","title":"Pre-training Generative Recommender with Multi-Identifier Item Tokenization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04400","snapshot_observed_at":"2026-08-05T00:28:27.721065Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:27.721065Z"},"links":{"cited_paper":"/paper/2504.04400","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:545bd490dbe59ca37fe240c5fa170e30cf05ea8a220f7283444899386e4a1a27","observation_id":"80cd5363-288c-4815-a432-294e35c3b5f7","resolution":{"observed_at":"2026-08-05T00:28:27.721065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2510.21276","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"arXiv (Cornell University)","work_id":"8bdce3a1-6a82-45a9-82ec-1e36247957e8","year":2025},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:27.896015Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:900479043f542716866da5d221b18f8e1baa844317dabcd018dc595f3986d139","observation_id":"57ce162e-72f4-425b-9e5b-b41147018a58","resolution":{"observed_at":"2026-08-05T00:28:29.260012Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-07T21:08:28.375513+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T21:08:28.375513+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:28.024819Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:28.024819Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:f8703a9277ba9ef9fbf45bef2afa00cda3d5e6e91b29bb624b310d2f3ccfe382","observation_id":"088474c6-6eba-45df-b297-83a28e53de6d","resolution":{"observed_at":"2026-08-05T00:28:28.024819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:46.204762Z","title":null,"venue":null,"work_id":"c8c4056e-9348-4af0-bac7-b045276add05","year":null},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:28.259231Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:3651180e58b779392e6a68a7b4727307eeab3ff1779edfc6cc973d5ea07d7a93","observation_id":"0364f395-21fb-4555-8e2e-268ec6771198","resolution":{"observed_at":"2026-08-05T00:28:46.334763Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:27.407789Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:27.407789Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:d3c0a23d23edadc53263b85d22caa262c5f58ea309a4536dd687e160d67e615a","observation_id":"6b4b9b1a-2643-4ccb-ac7c-19209cabf955","resolution":{"observed_at":"2026-08-05T00:28:27.407789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:28.194852Z","title":"InProceedings of the 24th ACM SIGKDD International Conference on Knowledge Discovery & Data Mining","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:28.194852Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:a941d38e176b54f08118d9cd835a6ff0b2ea6f83a8d158a781779eb6912aa6ab","observation_id":"ff576ea8-c4c4-4c7b-867e-98770bc93160","resolution":{"observed_at":"2026-08-05T00:28:28.194852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7575.24882","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:38.854769Z","title":"https://doi.org/10.1145/2487575.2488200","venue":null,"work_id":"79dcded7-2dd0-459e-bc70-2a5d2719771f","year":null},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:21.990246Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:c8184f2863ebb4d37836ee8142a00a9bb591eb61868ed1240059085777ad21e3","observation_id":"9de1e021-e197-4287-b433-93547b425ccb","resolution":{"observed_at":"2026-08-05T00:28:39.114769Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1502.05477","last_updated":"2017-04-20T18:04:12Z","snapshot_observed_at":"2026-08-15T12:05:11.299477Z","submitted_at":"2015-02-19T06:44:25Z","title":"Trust Region Policy Optimization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.05477","snapshot_observed_at":"2026-08-05T00:28:22.831053Z","title":"arXiv:1502.05477","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:22.831053Z"},"links":{"cited_paper":"/paper/1502.05477","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:0f92e7aa30f3872cf8f31c05d5d197929d157b73711722fbb0b7c827a2e0a576","observation_id":"1bb2910d-60c3-4d34-9d89-f49d2c559ab3","resolution":{"observed_at":"2026-08-05T00:28:22.831053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06939","last_updated":"2016-03-29T14:52:58Z","snapshot_observed_at":"2026-08-15T14:18:11.908702Z","submitted_at":"2015-11-21T23:42:59Z","title":"Session-based Recommendations with Recurrent Neural Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06939","snapshot_observed_at":"2026-08-05T00:28:20.504770Z","title":"In International Conference on Learning Representations (ICLR)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:20.504770Z"},"links":{"cited_paper":"/paper/1511.06939","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:000eb2a04287af3e120e370b106639db7d63ed2ca40ce3abad70143abb04a53c","observation_id":"48a5cf55-1557-4205-8a48-1c2d51670287","resolution":{"observed_at":"2026-08-05T00:28:20.504770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T00:28:23.405912Z","title":"https://doi.org/10.48550/arXiv","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:23.405912Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:a8f66d1f86d3da94fce21b8383fca6e0a6a7b0942fb11a2ee53d44361acc68b5","observation_id":"4634ba9f-fbef-43ce-8b9b-19862d7e9f8e","resolution":{"observed_at":"2026-08-05T00:28:23.405912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:28.594848Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:28.594848Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:36cd9f4e120a4e6cf3f84115ee8eff46e00f03ea62f54aab2b09ecb020f61a67","observation_id":"58af000d-ae0b-4efd-a84d-d13c41d183ac","resolution":{"observed_at":"2026-08-05T00:28:28.594848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:28:21.118129Z","title":"InProceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:21.118129Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:45b9e63a84c7d0bcc3e88ce44f7937e6ae292cb87d24e7558406e5460ba7481b","observation_id":"7d6c69f3-305d-4500-adf2-ef0b9c581616","resolution":{"observed_at":"2026-08-05T00:28:21.118129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2511.18793","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"https://doi.org/10.48550/arXiv.2511.18793 arXiv:2511.18793 [cs.AI]","venue":"Open MIND","work_id":"c45b8ad8-d476-4b56-9b2b-5a7aa21a535f","year":null},"citing_paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:26.875167Z"},"links":{"citing_paper":"/paper/2608.00750"},"observation_digest":"sha256:e835b0edf091e6e8c534811c80c1aa71922fce3c4b311a0794ddfb1718094aef","observation_id":"e6448f35-ae2b-448a-b6ee-c3c499455c11","resolution":{"observed_at":"2026-08-05T00:28:30.369620Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-07T21:08:28.862877+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T21:08:28.862877+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.00750","last_updated":"2026-08-01T16:33:15Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-16T04:29:46.345202Z","submitted_at":"2026-08-01T16:33:15Z","title":"Hierarchical Residual Policy Optimization for Generative Recommendations"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":6,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":52,"verified_exact":9,"verified_fuzzy":1},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 0 inbound Pith citation observations for arXiv:2608.00750."}